WAV فائلوں کو speaker لیبلز کے ساتھ ٹرانسکرائب کریں۔بے نقصان کوالٹی۔

اپنی WAV ریکارڈنگ براہ راست اپنے فیلڈ رگ، DAW بائونس، یا انٹرویو کٹ سے ڈراپ کریں۔ ہم 24-bit headroom برقرار رکھتے ہیں، خام PCM پر diarization چلاتے ہیں، اور منٹوں میں SRT کے ساتھ ٹائم سٹیمپ شدہ ٹرانسکرپٹ واپس کرتے ہیں۔

اپنی آڈیو یا ویڈیو ڈالیں

MP3 · WAV · M4A · MP4 · MOV · MKV · OGG · OPUS · FLAC · WEBM — up to 100 MB anonymously

Paste a link, we’ll fetch the audio

YouTube · TikTok · Vimeo · Twitter · SoundCloud · Spotify · 50+ more

Record straight from your browser

Sign up takes 30 seconds — recording opens right after, in the dashboard.

No card required~90s per 60-min fileSRT · VTT · DOCX · TXTفائلیں 24 گھنٹے میں آٹو-ڈیلیٹ ہو جاتی ہیں

↓ دیکھیں کہ کیا نکل کر آتا ہے

خام PCM میں۔ صاف ٹرانسکرپٹ باہر۔

بے نقصان WAV مطلب ہے ہر sibilant، plosive، اور خاموش لفظ برقرار رہتا ہے — MP3 consonants کو smear نہیں کرتا۔ اگر فائل multi-track ہے (ایک speaker فی channel)، ہم acoustic diarization مکمل طور پر چھوڑ دیتے ہیں اور channel layout پر تقسیم کرتے ہیں۔

WAV · 48 kHz / 24-bitREC 2 tracks · 1h 12m · 743 MB
خودکار طور پر detected en-GBstereo PCM · uncompressed
~90s
ٹرانسکرپٹ · streaming97% درستگی
S1

مجھے اس صبح والے دن پر واپس لے جایں — کال کب آئی تھی؟

S2

پانچ بجے کا سوال، کم و بیش۔ پانی کا برتن بند تھا، مجھے یہ یاد ہے۔

S1

اور وہاں سے آپ براہ راست بندرگاہ کی طرف گئے؟

S2

براہ راست boatyard۔ روشنیاں ابھی جل رہی تھیں جب میں اندر آیا۔

per-track WAV پر 97%SRT · DOCX · TXT · JSON

↓ This is the dashboard

This is what loads when the job finishes.

Same layout as the real dashboard — Summary, full Transcript, Speakers tab, Exports. Key points and action items extracted automatically. Auto-tags on every job.

Try it on your own file — it's free

تین حقیقی اختیارات · ا��ماندارانہ موازنہ

Adobe Audition۔ Descript۔ یا ہم۔

Audition کا Speech to Text Creative Cloud کے ساتھ بنڈل ہوا ہے اور ٹائم لائن کے اندر رہتا ہے۔ Descript WAV کو اپنے ایڈیٹر میں import کرتا ہے۔ ہم فائل کو ہے ہی لے لیتے ہیں، معیاری ایکسپورٹ واپس کرتے ہیں، اور آپ سے اپنے پروجیکٹ کو کہیں اور منتقل کرنے کو نہیں کہتے۔

Option 01

Adobe Audition / Premiere

Adobe ٹائم لائن کے اندر ٹرانسکرپٹ پینل۔ Creative Cloud اور پروجیکٹ فائل کے ساتھ منسلک۔

ضروری ہےCreative Cloud رکنیت
Speaker diarizationہاں، صرف mixed-down
Multi-track WAVSTT سے پہلے Flattened
ایکسپورٹSRT · CSV · XML
زبانیں18، دستی انتخاب
لاگت~$23/mo (اکیلی app)
Best forوہ ایڈیٹرز جو Premiere یا Audition میں پہلے سے کاٹ رہے ہوں اور caption کو ٹائم لائن میں سلایا ہوا چاہتے ہوں۔
Option 02

Transcription.Solutions

WAV حذف کریں۔ Multi-track ہو تو per-channel diarization۔ ماخذ 24h میں حذف کیا گیا۔

ضروری ہےکچھ نہیں — صرف فائل
Speaker diarizationPer-track یا acoustic
Multi-track WAV16 channels تک
ایکسپورٹSRT · VTT · DOCX · TXT · JSON
زبانیں99، خودکار detected
لاگت · فی منٹ$0.03
Best forکوئی بھی جو خام WAV رکھتا ہے — فیلڈ ریکارڈسٹ، DAW سے پوڈ کاسٹر بائونس کر رہے ہوں، شفاہی تاریخ آرک��ئوکارز، محققین۔
Option 03

Descript

آپ کا WAV Descript کے ایڈیٹر میں import کرتا ہے۔ طاقتور، لیکن اس کے اندر کام کرنا پڑ تا ہے۔

ضروری ہےDescript اکاؤنٹ + import
Speaker diarizationAcoustic، EN-tuned
Multi-track WAVالگ clips کے طور پر import
ایکسپورٹTXT · SRT · DOCX
زبانیں23، درستگی مختلف ہے
لاگت$16–24/user/mo
Best forپوڈ کاسٹ ایڈیٹرز جو ٹرانسکرپٹ میں ترمیم کر کے آڈیو میں ترمیم کرنا چاہتے ہوں — Descript کی اصل طاقت۔

قیمت درست ہے 2026 میں۔ Adobe اور Descript feature flags اکثر تبدیل ہوتے ہیں؛ commit کرنے سے پہلے موجودہ docs چیک کریں۔

WAV کے لیے محدود

تین چیزیں generic ٹرانسکرپشن ٹولز۔

زیادہ تر uploaders خاموشی سے آپ کا WAV downsample کرتے ہیں recognizer کو بھیجنے سے پہلے۔ ہم نہیں۔

کیا غلط ہوتا ہے

  1. 1Multi-track WAV flattened ہوتا ہے۔ Sound Devices MixPre سے 4-channel فیلڈ ریکارڈنگ STT سے پہلے mono میں mixed ہوتی ہے۔ Per-mic separation جس کے لیے آپ نے ادا کیا وہ ضائع ہو جاتا ہے۔
  2. 232-bit float WAVs Zoom F-series یا MixPre سے مکمل طور پر مسترد ہو جاتے ہیں، یا 16-bit تک clipped ہوتے ہیں اور اپنا headroom recovery کھو دیتے ہیں۔
  3. 396 kHz / 24-bit interviews ہمیشہ کے لیے اپ لوڈ لیتے ہیں کیونکہ tool browser میں MP3 میں دوبارہ encode کرتا ہے بھیجنے سے پہلے۔

یہاں کیا پلٹائیں

  1. 1Multi-track WAV ہے ہی اپ لوڈ کریں (16 channels تک)۔ ہم WAV ہیڈر سے channel layout پڑھتے ہیں اور ایک speaker کو ہر ٹریک میں assign کرتے ہیں — کوئی acoustic guessing نہیں۔
  2. 232-bit float native طور پر قبول کیا جاتا ہے۔ ہم float headroom preserve کرتے ہیں جب recognizer کے لیے normalize کرتے ہیں، تو 0 dBFS سے اوپر peaks clipped نہیں ہوتے۔
  3. 3براہ راست binary upload، browser میں کوئی transcode نہیں۔ 2 GB WAV آپ کے مکمل bandwidth میں منتقل ہوتا ہے اور آخری byte آنے کے لحظے processing شروع ہوتی ہے۔

WAV کے لیے تجویز کردہ job سیٹنگز

WAV ڈراپ کریں اور یہ default سے flip ہوں۔ ہر job سے override کریں فارم سے۔

Sample rate
Native (no downsample)
Bit depth
24-bit / 32-float محفوظ
Diarization
Per-channel اگر multi-track
Speaker model
انٹرویو · 2-8 speakers
Filler words
محفوظ (ضرورت ہو تو off toggle کریں)
ایکسپورٹ
DOCX · SRT · timestamped TXT

Accuracy · real-world numbers

per-track WAV پر 97%+۔ WAV recognizer کو سب سے صاف ممکنہ سگنل دیتا ہے۔

کیونکہ WAV کوئی perceptual compression کے بغیر خام PCM محفوظ کرتا ہے، consonants اور sibilants وہی طریقے نہیں ہیں جیسے MP3 انہیں smear کرتا ہے۔ Recognizer سنتا ہے جو microphone نے سنا۔ نیچے کی تعداد production میں حقیقی customer WAV jobs سے آتی ہے۔

98%
Studio WAV · اکیلا speaker

48 kHz / 24-bit، large-diaphragm condenser، treated room۔ Narration، audiobook، voice-over bookings یہاں آتی ہیں۔

96%
Multi-track انٹرویو WAV

ایک channel فی speaker (lavs یا boundary mics)۔ Diarization صرف channel routing ہے — text-only error۔

92%
ہینڈ ہیلڈ فیلڈ ریکارڈر

Zoom H5، Tascam DR-40، similar۔ Stereo XY pickup، 2-3 speakers، کچھ اضافی reflection۔ زیادہ تر پوڈ کاسٹ WAVs یہاں آتے ہیں۔

85%
شور والا ماحول فیلڈ WAV

باہر، café، گاڑی۔ Lossless capture مدد دیتا ہے — شور اصل ہے، codec artefact نہیں — لیکن overlapping speech پر درستگی ابھی بھی گر جاتی ہے۔

عام سوالات

8 چیزیں جو لوگ WAV ٹرانسکرپشن کے بارے میں پوچھتے ہیں۔

01زیادہ سے زیادہ WAV فائل سائز کیا ہے؟+
معیاری plan پر 5 GB فی فائل، جو تقریباً stereo 48 kHz / 24-bit کے 8 گھنٹے، یا 96 kHz / 24-bit کے 2.5 گھنٹے ہے۔ بڑی فائلیں team plan پر اچھی ہیں — اپ لوڈ سے پہلے صرف ہم سے رابطہ کریں۔
02کیا آپ Zoom F-series یا MixPre سے 32-bit float WAV کو سپورٹ کرتے ہیں؟+
ہاں، native طور پر۔ ہم float نمونوں کو 0 dBFS پر clipping کے بغیر پڑھتے ہیں، تو لاؤڈ transients جو آپ نے post میں نیچے کھینچنے کا منصوبہ بنایا ہے وہ ابھی بھی صاف طریقے سے transcribe ہوتے ہیں۔ زیادہ تر عام uploaders خاموشی سے 16-bit میں down-cast کرتے ہیں۔
03میرے پاس فیلڈ ریکارڈر سے 4-channel WAV ہے — ایک mic فی شخص۔ کیا diarization اسے استعمال کرے گا؟+
یہ کرے گا۔ براہ راست polyphonic WAV اپ لوڈ کریں (پہلے stereo میں bounce نہ کریں)۔ ہم WAV ہیڈر سے channel layout parse کرتے ہیں اور ایک speaker کو ہر ٹریک میں assign کرتے ہیں — مماثل voices پر acoustic diarization سے بہت زیادہ قابل اعتماد۔
04کیا آپ میرا 96 kHz WAV downsample کریں گے؟+
Recognizer 16 kHz پر internally چلتا ہے — یہ انسانی speechintelligibility کی ceiling ہے۔ لیکن ہم آپ کی original فائل کو غیر تبدیل رکھتے ہیں اور اسے noise gating جیسی post-processing کے لیے استعمال کرتے ہیں۔ آپ کے exports original timeline کو reference کرتے ہیں۔
05کیا WAV transcription کے لیے MP3 سے اصل میں زیادہ درست ہے؟+
معمولی جی ہاں — عام طور پر صاف speech پر WER کے 1-2 نکات۔ بڑا فاصلہ sibilants اور خاموش مقطعات پر دکھائی دیتا ہے، جہاں MP3 کی psychoacoustic compression وہ معلومات ضائع کرتا ہے جو recognizer نے استعمال کی ہوتی۔ آرکائیول یا forensic کام کے لیے، WAV صحیح کال ہے۔
06کیا BWF metadata اور timecode محفوظ ہیں؟+
ہم BWF chunks (bext، iXML) پڑھتے ہیں اور start timecode کو اپنے session timeline کے transcript کو align کرنے کے لیے استعمال کرتے ہیں۔ Original WAV کو کبھی modify نہیں کیا جاتا — ہم ایک copy پر کام کرتے ہیں جو 24h کے اندر حذف کر دیا جاتا ہے۔
07کیا میں DAW session export سے WAV فائلوں کا folder ڈراپ کر سکتا ہوں؟+
ہاں۔ Batch upload ایک وقت میں 50 فائلوں تک قبول کرتا ہے۔ ہر WAV کو اپنا job اور transcript ملتا ہے۔ اگر وہ ایک session سے stems ہیں، تو آپ انہیں اپ لوڈ sے پہلے ایک multi-track WAV میں بھی merge کر سکتے ہیں اور ہم per channel میں diarize کریں گے۔
081 گھنٹے کا stereo WAV اصل میں کتنا وقت لیتا ہے؟+
اپ لوڈ سب سے سست حصہ ہے — 1 گھنٹے کا 48 kHz / 24-bit stereo WAV تقریباً 600 MB ہے اور عام broadband پر 2-5 منٹ لیتا ہے۔ ایک بار اپ لوڈ ہو جانے کے بعد، transcription خود تقریباً 4-6 منٹ معیاری queue پر چل جاتی ہے۔

اپنی WAV ڈراپ کریں۔ بے نقصان کوالٹی رکھیں۔ دیکھیں کہ کیا نکل کر آتا ہے۔

ہر ماہ 30 مفت منٹ۔ کوئی کارڈ نہیں۔ Per-track diarization، 32-bit float سپورٹڈ، ماخذ آڈیو 24h میں حذف کیا گیا۔

شروع کریں مفید میں