ڊگھي آڊيو فائلن کو ٽرانسڪرائب ڪريو۔10 ڪلاڪ تائين۔ ڪوئي ٽائم آئوٽ نه۔

ڏگھي آڊيو فائل ڊراپ ڪريو — 10 ڪلاڪ تائين، Business تي 5 GB. اسي متوازي chunk ڪريو، speaker IDs شروع کان آخر تائين مستقل رکو، ۽ نمبر والو فولڈر بجائے ھڪ ٽرانسڪرپٽ واپس ڪريو.

پنهنجو آڊيو يا وڊيو هتي ڇڏيو

MP3 · WAV · M4A · MP4 · MOV · MKV · OGG · OPUS · FLAC · WEBM — up to 100 MB anonymously

Paste a link, we’ll fetch the audio

YouTube · TikTok · Vimeo · Twitter · SoundCloud · Spotify · 50+ more

سڌو پنھنجي برائوزر مان رڪارڊ ڪريو

سائن اپ 30 سيڪنڊن ۾ ٿئي ٿو — ان بعد سڌو ڊيش بورڊ ۾ رڪارڊنگ کلي ٿي.

No card required~90s per 60-min fileSRT · VTT · DOCX · TXTفائلون 24 ڪلاڪن ۾ خودڪار ڊليٽ ٿي وڃن ٿيون

↓ ھڪ 5-ڪلاڪ جي فائل، درميانو ٽرانسڪرپٽ

ڪلاڪ اندر. ھڪ صاف فائل باهر.

اڪثر ٽولس 90-منٽ جي نشان جے گرد ٽائم آئوٽ ڪري ويندا آهن يا توهان جي ڏگھي ريڪارڊنگ کو نمبر والي جزويات ۾ ورهايندا آهن جيڪي توهان کو سلاي ۾ رکڻو پوندو. اسي 12-منٽ overlapping windows ۾ chunk ڪريو، انھن کو متوازي ميں پروسيس ڪريو، ۽ عام speaker pass سان دوبارہ جوڙو.

بورڊ حکمت عملي سيشنREC 3 speakers · 5:14:22 · 3.1 GB
auto-detected en-GB44.1 kHz stereo · 192 kbps
~90s
Transcript · single file92% درستگي · t=3:14:08
S1

اسي ٽئي ڪلاڪ اندر آهيون — چلو صبح جي سيشن کان سپلائي چيين پوائنٽ ڏانهن واپس وڃو.

S2

صحيح، Vietnam جي manufacturing pivot. مان سمجهان ٿو اسي lead-time جي خطرن کي نظر اندازي ڪيو.

S1

Lead times tariff تبديلي کان بعد 14 کان 31 ڏينهن وڌي ويا.

S3

۽ اهو Long Beach تي port congestion کي شامل ڪرڻ کان پهريان آهي۔

92% مڪمل 5h فائل توڙيDOCX · SRT · TXT · JSON

↓ This is the dashboard

This is what loads when the job finishes.

Same layout as the real dashboard — Summary, full Transcript, Speakers tab, Exports. Key points and action items extracted automatically. Auto-tags on every job.

Try it on your own file — it's free

ٽي اصل اختيار · ايمانداري جو موازنو

Otter Pro. DIY Whisper chunking. يا اسي.

Consumer ٽولس فائل جي ڊگھائي کو محدود ڪندا آهن ۽ خاموشيسان truncate ڪندا آهن. Whisper API 25 MB per-request جي حد رکندو، تنهنڪري توهان chunker خود بناندا. اسي پوري 10-ڪلاڪ فائل قبول ڪنو ۽ ھڪ ٽرانسڪرپٽ واپس ڪنو.

Option 01

Otter Pro

ڊگھي فائلن کو ريڪارڊنگ دوسرو 4 ڪلاڪ تائين محدود ڪندو. Speaker labels 2-ڪلاڪ جي نشان کانپوء drift ڪري ويندا.

زيادہ تر فائل ڊگھائي4 ڪلاڪ (Pro tier)
زيادہ تر فائل سائز~1.5 GB upload
Speaker IDs شروع کان آخر تائين2 ڪلاڪن کانپوء Drift
ڏگھي-فائل outputSingle doc، cap تي truncated
قيمت$16.99/صارف/مهينو
دوبارہ شروع ڪر سگھندڙ uploadنه
Best for2 ڪلاڪن کان گهٹ ميٹنگس. ڏينهن جي طويل ريڪارڈنگن تي ناڪام ٿي وڃندو.
Option 02

Transcription.Solutions

10 ڪلاڪ فائل دوسرو. متوازي chunking، عام speaker pass، ھڪ DOCX باهر.

زيادہ تم فائل ڊگھائي10 ڪلاڪ (Pro & Business)
زيادہ تر فائل سائز2 GB Pro · 5 GB Business
Speaker IDs شروع کان آخر تائينGlobal embedding pass
ڏگھي-فائل outputSingle file · DOCX/SRT/TXT
قيمت · في منٽ$0.03 flat ڊگھائي سان قطع نظر
دوبارہ شروع ڪر سگھندڙ uploadMultipart، ڊراپس سے بچي وڃندو
Best forڏينهن جي ڊيگھي ورڪشاپ، depositions، بورڊ ميٽنگ، oral histories — 90-منٽ جي ديوار کانپوء ڪو ڪجهه.
Option 03

Whisper API + DIY chunking

منٽ توڙي سڄو سستو. توهان chunker، speaker stitch، ۽ retry logic بناندا.

زيادہ تري فائل ڊگھائي25 MB في درخواست (~25 منٽ)
زيادہ تري فائل سائز25 MB سخت حد
Speaker IDs شروع کان آخر تائينڪوئي نه — ڪوئي diarization نه
ڏگھي-فائل outputنمبر والي جزويات، توهان سلايو
قيمت · في منٽ$0.006 (OpenAI Whisper)
انجنيئرنگ وقتڪلاڪ کان ڏينهن في pipeline
Best forEngineers جيڪي raw متن في chunk چاهندا آهن ۽ speakers، summaries، يا سنگل output جي ضرورت نه رکندا.

Pricing ۽ limits May 2026 کي درست. Otter Pro length cap آخري مرتبہ ان جي عوامي pricing تي تصديق ٿيو.

ڏگھي فائلن کي specific

ٽي طريقا عام ٽولس 90-منٽ جي نشان کانپوء مري وڃن۔

اڪثر pipelines ھڪ-ڪلاڪ ميٽنگن لاء بنايا ويا. ڏگھو آڊيو انھن کو پيشن گوئي ڪريل طريقن کي ڀاڱندو — اتھي ته اسي ڪجهه مختلف ڪردا آهيون۔

ڇا غلط ٿو وڃي

  1. 190 منٽ تي خاموش ٽائم آئوٽ. نوڪري ھڪ ڪلاڪ لاء گھومي، پوء مفيد غلطي بغير مار وڃي. توهان کي کيس بازار واپس ڪرڻ لاء ڪجهه نٿو آهي۔
  2. 2Speaker IDs chunks جي وچ ۾ drift ڪري وڃن۔ Speaker 1 ڪلاڪ 1 تي Speaker 4 بڻي وڃي ڪلاڪ 3 تي ڇو ته هر chunk الگ diarized ٿو وڃي۔
  3. 3Output ھڪ نمبر والو فولڊر آهي۔ `transcript_part_01.txt` `transcript_part_24.txt` تائين ھر chunk حد تي timestamp resets سان. توهان ان کي خود سلايو۔

ڇا flip ڪرڻ لاء هتي

  1. 1دوبارہ شروع ڪر سگھندڙ multipart upload. Connection hour 2 تي ڊراپ ٿي وڃي upload جو 4 GB جي؟ آخري مڪمل حصي کان دوبارہ شروع. 4 GB جو ڪوئي دوبارہ upload نه.
  2. 2عام speaker embedding pass. في-chunk diarization کان بعد، اسي آوازن کو مڪمل فائل توڙي cluster ڪريو تنهنڪري Speaker 3 منٽ 12 تي ۽ منٽ 487 تي ساڳي ماڻهو آهي۔
  3. 3Single DOCX hour markers سان۔ ھڪ فائل، مسلسل timestamps، اختياري حصو ٽوڙ هر 60 منٽ. ڪوئي سلائي نه۔

ڏگھي فائلن لاء سفارش ڪيل job settings

90 منٽ کي گهٽ ڪجهه drop ڪريو ۽ اهي خودڪار flip آن. form کان في-job override.

Chunk حکمت عملي
12 منٽ windows · 10s overlap
Diarization
عام pass تمام chunks توڙي
Speaker ماڊل
Long-form · 2-20 speakers
Upload
دوبارہ شروع ڪر سگھندڙ multipart
Queue
ترجيح (Business منصوبو)
Export
Single DOCX · hour markers تي

Accuracy · real-world numbers

92% 5-ڪلاڪ جي فائل توڙي رھي جندو. معيار ڪلاڪ-ڪلاڪ توڙي رھي جندو.

ڏگھي آڊيو سان سخت حصو ماڊل نه آهي — اهو accuracy کو منٽ 1 کان منٽ 600 تائين صاف رکڻ آهي. Speaker drift ۽ chunk-boundary غلطيون اهي آهن جيڪي اڪثر pipelines کو ماريندا آهن. ہيٺاهي تعداد مڪمل ڌڌ صارف فائلن توڙي ماپي ويا آهي، پهريلا 10 منٽ نه.

95%
Studio long-form، سنگل speaker

Audiobook narration، سولو podcast، لکيل manuscript. 6-10 ڪلاڪ صاف آواز ڪوئي room noise بغير. ڪوئي diarization ضرورت نه.

92%
Boardroom، 2-6 speakers

Conference ٽيبل، ڀليڪ mic، 3-5 ڪلاڪ. عام speaker pass IDs کو مڪمل فائل توڙي مستقل رکندو.

88%
All-day ورڪشاپ، lapel mics

7-9 ڪلاڪ جي training ڏينھ mic handoffs ۽ audience Q&A سان. نالا speaker chips تي 5-منٽ pass ضرورت.

82%
Field roundtable، 8+ speakers

ڏگھي oral history، focus group، يا panel overlapping vocalist ۽ ambient noise سان. استعمال ڪريل، پر cleanup جي توقع رکو.

عام سوال

8 شيون جيڪي ماڻهو پڇن ٿا۔ ڊگھي آڊيو ٽرانسڪرپشن بابت

01اصل فائل ڊگھائي ۽ سائز حد ڇا آهي؟+
دونهيں Pro ۽ Business تي فائل دوسرو 10 ڪلاڪ۔ Pro فائل سائز 2 GB تي محدود ڪندو، Business 5 GB تي. جيڪڏهن توهان وٽ 10 ڪلاڪن کان ڊگھو ڪجهه آهي، اهو ھڪ قدرتي ڀڄ تي ورهايو — اسي speaker IDs کو مستقل رکندو جيڪڏهن توهان انھن کو تولهڻ ۽ ڇال تي واپس ڪندا.
02مون کي ھڪ ٽرانسڪرپٽ يا نمبر والي جزويات جو فولڊر ملندو؟+
ھڪ فائل. ھميشه. DOCX، SRT، TXT، يا JSON — توهان جي پسند. Timestamps شروع 00:00:00 کان ريڪارڊنگ جي آخر تائين مسلسل چلندا، ھر chunk حد تي reset نه.
036-ڪلاڪ جي فائل واپس اچڻ ڪيترو وقت ٽيکندو؟+
تقريباً 18-25 منٽ Pro queue تي، 8-12 Business ترجيح تي. اسي 12-منٽ chunks کو متوازي ميں پروسيس ڪندا، تنهڪري wall-clock وقت فائل ڊگھائي سان sub-linearly scales ڪندو، نه منٽ-في-منٽ۔
04ڇا speaker IDs شروع کان آخر تائين مستقل رھن؟+
ھاڻي. في-chunk diarization کان بعد، ھڪ عام embedding pass مڪمل فائل توڙي آوازن کو cluster ڪندو. Speaker 3 منٽ 12 تي منٽ 487 تي ساڳي Speaker 3 آهي. اهو اڪثر DIY Whisper pipelines غلط ڪي وڃن ٿيڪ آهي۔
05اگر 4 GB فائل جي hour 3 تي منهنجو upload drop ٿي وڃي؟+
دوبارہ شروع ڪر سگھندڙ multipart upload آخري مڪمل حصي کان واپس چونڊي. توهان پهريلا 3 GB دوبارہ upload نٿا ڪندا. flaky hotel Wi-Fi ۽ cellular tethering تي ڪم ڪندو — اسي دونهيں جانچيا.
06ڇا Whisper API ڏگھي فائلن تي choke ڪندو؟+
OpenAI جي Whisper endpoint 25 MB في-درخواست سخت حد رکندو — تقريباً 25 منٽ compressed آڊيو جو. ڪوئي ڊگھو ضرورت ڪندو chunk، transcribe متوازي ميں، پوء transcripts ۽ align speakers خود سلايو. اسي اهو تمام server-side ڪندا.
07ڇا في-منٽ قيمت 10-ڪلاڪ فائل تي 10-منٽ فائل وانگر ساڳي آهي؟+
ھاڻي. $0.03 في منٽ flat، ڊگھائي سان قطع نظر. 10-ڪلاڪ فائل $18 cost. اسي ڏِگھي فائلن تي surcharge نه ڪندا جيڪڏهن Rev ڪندو ($1.50/min انساني × 10 ڪلاڪ = $900).
08ڇا مان chapter markers يا timestamps هر ڪلاڪ ملي سگهان؟+
job form تي 'Hour markers' toggle آن ڪريو ۽ DOCX 60 منٽ هر حصو ٽوڙ heading سان export. SRT مسلسل timecode رکندو. JSON دونهيں رکندو — chapter array اضافي word-level timestamps۔

توهان جي ڏگھي فائل ڊراپ ڪريو۔ ھڪ ٽرانسڪرپٽ واپس حاصل ڪريو۔

هر مهينو 30 آزاد منٽ. ڪوئي ڪارڊ نه. 10 ڪلاڪ تائين فائل، speaker labels جيڪي مستقل رھن، single-file export.

آزاد شروع ڪريو