Whisper مقامی / اوپن سورس
مفت اگر آپ کے پاس GPU اور ایک دوپہر ہے۔ براہ راست اسپیکر diarization نہیں۔
MP3 فائل کو 64 سے 320 kbps تک کسی بھی bitrate پر ڈراپ کریں۔ 99 زبانوں میں ایک ٹائم اسٹیمپڈ، اسپیکر لیبل والا ٹرانسکرپٹ حاصل کریں — کوئی فارمیٹ تبدیلی نہیں، کوئی دوبارہ encoding نہیں، کوئی queue میں انتظار نہیں۔
MP3 · WAV · M4A · MP4 · MOV · MKV · OGG · OPUS · FLAC · WEBM — up to 100 MB anonymously
YouTube · TikTok · Vimeo · Twitter · SoundCloud · Spotify · 50+ more
↓ دیکھیں کہ کیا نکلتا ہے
ہم MP3 frame headers کو براہ راست پڑھتے ہیں — VBR، CBR، joint-stereo، کوئی بھی encoder (LAME، Fraunhofer، FFmpeg)۔ اگر فائل علیحدہ channels پر اسپیکرز کے ساتھ true stereo ہے تو ہم اسے آوازوں کو الگ کرنے کے لیے استعمال کرتے ہیں۔ Mono mix-down acoustic diarization پر واپس آتا ہے۔
تو آپ نے پہلی بار کب محسوس کیا کہ آرکائیو نامکمل ہے؟
شاید 2019 کے ارد گرد، جب ہم نے reel-to-reels کو digitising شروع کیا۔
اور گمشدہ ٹیپیں — کیا وہ کہیں catalog کی گئی تھیں؟
'78 سے ایک کاغذی انڈیکس ہے، لیکن اس کا آدھا حصہ پانی سے خراب ہے۔
↓ This is the dashboard
Same layout as the real dashboard — Summary, full Transcript, Speakers tab, Exports. Key points and action items extracted automatically. Auto-tags on every job.
Sample preview from a founder interview about post-call workflow. Real transcripts look exactly like this — same tabs, same summary block, same key-points / action-items split, same auto-tag chips.
تین حقیقی اختیارات · ایماندار موازنہ
آپ اپنے لیپ ٹاپ پر مفت میں Whisper چلا سکتے ہیں اگر آپ تکنیکی ہیں۔ Otter اور Sonix subscription dashboards میں MP3 اپ لوڈ قبول کرتے ہیں۔ ہم فائل لیتے ہیں، ٹرانسکرپٹ واپس دیتے ہیں، اور آپ کو کسی UI کے اندر رہنے کا مجبور نہیں کرتے۔
مفت اگر آپ کے پاس GPU اور ایک دوپہر ہے۔ براہ راست اسپیکر diarization نہیں۔
MP3 کو ڈراپ کریں۔ اسپیکر لیبل والا ٹیکسٹ تقریباً حقیقی وقت میں × 0.025 میں واپس حاصل کریں۔
Polished dashboard، ماہانہ منٹوں کی حد، English-tuned۔ فائل اپ لوڈ ایک طرفہ خصوصیت محسوس ہوتی ہے۔
قیمتیں اور خصوصیت کی دستیابی مئی 2026 تک درست۔ Whisper کارکردگی ماڈل کے سائز اور ہارڈ ویئر کے لحاظ سے مختلف ہوتی ہے۔
MP3 کے لیے مخصوص
MP3 ایک فارمیٹ ہے، ریکارڈنگ کا انداز نہیں — جس کا مطلب ہے کہ ناکامی کے طریقے encoder سے آتے ہیں، speech سے نہیں۔
Defaults جو ~80% MP3 فائلز میں فٹ ہیں۔ فارم سے فی job override کریں۔
Accuracy · real-world numbers
MP3 درستگی جو encoder نے رکھا سے محدود ہے، ہم سے نہیں۔ Perceptual compression ~96 kbps سے اوپر speech intelligibility کو بہت اچھی طرح محفوظ رکھتا ہے؛ 64 kbps سے نیچے، sibilants اور consonants حل ہونے لگتے ہیں۔ نیچے کے اعداد production میں حقیقی customer MP3s سے ہیں۔
Speech کے لیے near-lossless۔ Podcast masters، dictation app exports، professional interview rigs۔ Diarization صاف اگر speakers علیحدہ channels پر ہیں۔
Spoken-word MP3s کے لیے سب سے عام bitrate۔ Zoom exports، Riverside downloads، voice recorders default۔ Compression artifacts recognizer کو غیر سنائی۔
Voice memo زیادہ تر phones پر defaults۔ Acoustic diarization 2-4 speakers کو سنبھالتا ہے۔ اعداد اور proper nouns کبھی کبھی ایک نگاہ کی ضرورت۔
پرانے answering-machine rips، lecture archives، narrow-band sources۔ High-frequency consonants (f/s/sh) blur ہو جاتے ہیں۔ اب بھی readable — proofread کا منصوبہ بنائیں۔
عام سوالات
ہر ماہ 30 منٹ مفت۔ کوئی کارڈ درکار نہیں۔ اسپیکر لیبلز، 99 زبانیں، ہر export format شامل۔
مفت شروع کریں