WAV ဖိုင်များကို speaker labels ဖြင့် transcribe လုပ်ပါ။Lossless အရည်အသွေး။

သင်၏ field rig, DAW bounce, သို့မဟုတ် interview kit မှ WAV recording ကို တိုက်ရိုက် drop လုပ်ပါ။ 24-bit headroom ကို မထိခိုက်စေဘဲ raw PCM ပေါ်တွင် diarization ပြုလုပ်ကာ timestamped transcript ကို SRT နှင့်အတူ မိနစ်အနည်းငယ်အတွင်း ပြန်ပေးပါမည်။

သင့်အသံ ဒါမှမဟုတ် ဗီဒီယိုကို ဆွဲချလိုက်ပါ

MP3 · WAV · M4A · MP4 · MOV · MKV · OGG · OPUS · FLAC · WEBM — up to 100 MB anonymously

Paste a link, we’ll fetch the audio

YouTube · TikTok · Vimeo · Twitter · SoundCloud · Spotify · 50+ more

browser ထဲကနေ တိုက်ရိုက် အသံဖမ်းပါ

စာရင်းသွင်းဖို့ ၃၀ စက္ကန့်ပဲ ကြာတယ် — ပြီးတာနဲ့ dashboard ထဲမှာ အသံဖမ်းဖို့ တန်းဖွင့်ပေးတယ်။

No card required~90s per 60-min fileSRT · VTT · DOCX · TXTဖိုင်များကို ၂၄ နာရီအတွင်း အလိုအလျောက် ဖျက်ပစ်တယ်

↓ ထွက်လာသည့်အရာကို ကြည့်ပါ

Raw PCM ဝင်။ သန့်ရှင်းသော transcript ထွက်။

Lossless WAV ဆိုသည်မှာ sibilant, plosive နှင့် တိုးတိုးပြောသော စကားလုံးတိုင်း မပျက်စီးဘဲ ကျန်ရှိနေသည် — MP3 က consonants ပေါ်တွင် ဖြစ်တတ်သော smear မရှိ။ ဖိုင်က multi-track (channel တစ်ခုလျှင် speaker တစ်ဦး) ဖြစ်ပါက acoustic diarization ကို လုံးဝ ကျော်ပြီး channel layout အပေါ်တွင် ခွဲခြားပါသည်။

WAV · 48 kHz / 24-bitREC tracks 2 ခု · 1h 12m · 743 MB
auto-detected en-GBstereo PCM · uncompressed
~90s
Transcript · streamingတိကျမှု 97%
S1

ခုနစ်ဆယ့်ရှစ်က မနက်ခင်းကို ပြန်ပြောပြပါ — ဖုန်းဝင်လာတဲ့ အချိန်က ဘယ်အချိန်လဲ?

S2

မနက် ၅ နာရီ မိနစ် ၄၅ လောက်ပေါ့။ ရေနွေးအိုးတည်နေတာ မှတ်မိသေးတယ်။

S1

အဲဒီကနေ ဆိပ်ကမ်းကို တိုက်ရိုက် မောင်းသွားတာလား?

S2

boatyard ကို တိုက်ရိုက်ပါ။ ကျွန်တော် ဝင်လာတဲ့အချိန် မီးတွေ ဖွင့်ထားတုန်းပဲ။

per-track WAV ပေါ်တွင် တိကျမှု 97%SRT · DOCX · TXT · JSON

↓ This is the dashboard

This is what loads when the job finishes.

Same layout as the real dashboard — Summary, full Transcript, Speakers tab, Exports. Key points and action items extracted automatically. Auto-tags on every job.

Try it on your own file — it's free

အမှန်တကယ် ရွေးချယ်စရာ ၃ ခု · ရိုးသားသော နှိုင်းယှဉ်ချက်

Adobe Audition။ Descript။ သို့မဟုတ် ကျွန်ုပ်တို့။

Audition ၏ Speech to Text သည် Creative Cloud နှင့်အတူ ပါဝင်ပြီး timeline အတွင်းမှာပင် ရှိနေသည်။ Descript သည် WAV ကို ၎င်း၏ editor အတွင်းသို့ import လုပ်သည်။ ကျွန်ုပ်တို့ကမူ ဖိုင်ကို မူရင်းအတိုင်း လက်ခံပြီး standard exports များ ပြန်ပေးကာ သင်၏ project ကို မည်သည့်နေရာသို့မျှ ရွှေ့ပြောင်းရန် မလိုပါ။

Option 01

Adobe Audition / Premiere

Adobe timeline အတွင်းရှိ Transcript panel။ Creative Cloud နှင့် project file တွင် ချည်နှောင်ထား။

လိုအပ်ချက်Creative Cloud subscription
Speaker diarizationဟုတ်၊ mixed-down သာ
Multi-track WAVSTT မလုပ်မီ ပြားအောင်လုပ်
ExportSRT · CSV · XML
ဘာသာစကား18 ခု၊ ကိုယ်တိုင်ရွေး
ကုန်ကျစရိတ်~$23/လ (app တစ်ခု)
Best forPremiere သို့မဟုတ် Audition တွင် ဖြတ်တောက်နေပြီး captions ကို timeline နှင့် ပူးတွဲချုပ်လိုသော editors များအတွက်။
Option 02

Transcription.Solutions

WAV ကို drop ချပါ။ Multi-track ဖြစ်ပါက per-channel diarization။ Source ကို 24h အတွင်း ဖျက်။

လိုအပ်ချက်ဘာမှ မလို — ဖိုင်တစ်ခုပဲ
Speaker diarizationPer-track သို့မဟုတ် acoustic
Multi-track WAV16 channels အထိ
ExportSRT · VTT · DOCX · TXT · JSON
ဘာသာစကား99 ခု၊ auto-detected
ကုန်ကျစရိတ် · မိနစ်တစ်ခုလျှင်$0.03
Best forRaw WAV ကိုင်ထားသူ မည်သူမဆို — field recordists, DAW မှ bounce လုပ်သော podcasters, oral history archivists, researchers များ။
Option 03

Descript

သင်၏ WAV ကို Descript ၏ editor အတွင်းသို့ import လုပ်သည်။ အားကောင်းသော်လည်း ၎င်းအတွင်းမှာသာ အလုပ်လုပ်ရမည်။

လိုအပ်ချက်Descript account + import
Speaker diarizationAcoustic, EN-tuned
Multi-track WAVသီးခြား clips အဖြစ် import
ExportTXT · SRT · DOCX
ဘာသာစကား23 ခု၊ တိကျမှု ပြောင်းလဲတတ်
ကုန်ကျစရိတ်$16–24/user/လ
Best forTranscript ကို edit လုပ်ခြင်းဖြင့် အသံကို edit လုပ်လိုသော podcast editors များ — Descript ၏ အမှန်တကယ် superpower။

ဈေးနှုန်းများသည် 2026 အတိုင်း မှန်ကန်ပါသည်။ Adobe နှင့် Descript တို့၏ feature flags များ မကြာခဏ ပြောင်းလဲသည် — အသုံးပြုခြင်းမပြုမီ လက်ရှိ docs များကို စစ်ဆေးပါ။

WAV အတွက် သီးခြား

လူများကို ဒုက္ခပေးတတ်သော အရာ ၃ ခု။ Generic transcription tools တွင်

Uploaders အများစုသည် သင်၏ WAV ကို recognizer သို့ မပို့မီ တိတ်တိတ်ဆိတ်ဆိတ် downsample လုပ်ပစ်ကြသည်။ ကျွန်ုပ်တို့ မပြုလုပ်ပါ။

ဘာတွေ မှားသွားလဲ

  1. 1Multi-track WAV ကို ပြားအောင်လုပ်ပစ်သည်။ Sound Devices MixPre မှ 4-channel field recording ကို STT မလုပ်မီ mono အဖြစ် mix လုပ်ပစ်သည်။ သင်ပေးထားသော per-mic ခွဲခြားမှု ပျောက်ဆုံးသွားသည်။
  2. 2Zoom F-series သို့မဟုတ် MixPre မှ 32-bit float WAVs များကို တိုက်ရိုက် ပယ်ပစ်ခြင်း သို့မဟုတ် 16-bit သို့ clip ဖြတ်ပြီး headroom recovery ဆုံးရှုံးသွားသည်။
  3. 396 kHz / 24-bit interviews များသည် ပို့ဆောင်ခြင်းမပြုမီ browser တွင် MP3 အဖြစ် re-encode လုပ်သောကြောင့် upload အလွန်ကြာသည်။

ဒီနေရာမှာ ဘာတွေ ပြောင်းရမလဲ

  1. 1Multi-track WAV ကို မူရင်းအတိုင်း upload တင်ပါ (16 channels အထိ)။ WAV header မှ channel layout ကို ဖတ်ပြီး track တစ်ခုလျှင် speaker တစ်ဦး သတ်မှတ်ပါသည် — acoustic ခန့်မှန်းခြင်း မရှိ။
  2. 232-bit float ကို မူရင်းအတိုင်း လက်ခံပါသည်။ Recognizer အတွက် normalising လုပ်စဉ်တွင် float headroom ကို ထိန်းသိမ်း ပါသည် — ထို့ကြောင့် 0 dBFS ထက် မြင့်သော peaks များ clip မဖြစ်ပါ။
  3. 3တိုက်ရိုက် binary upload, browser တွင် transcode မရှိ။ 2 GB WAV သည် သင်၏ bandwidth အပြည့်ဖြင့် ပို့ဆောင်ပြီး နောက်ဆုံး byte ရောက်သည်နှင့်တပြိုင်နက် processing စတင်ပါသည်။

WAV အတွက် အကြံပြုထားသော job settings

WAV တစ်ခုကို drop လုပ်လိုက်ပါက ဤအရာများ default အဖြစ် ဖွင့်သွားပါသည်။ Form မှ job တစ်ခုစီအတွက် override လုပ်နိုင်သည်။

Sample rate
Native (downsample မလုပ်)
Bit depth
24-bit / 32-float ထိန်းသိမ်း
Diarization
Multi-track ဖြစ်ပါက Per-channel
Speaker model
Interview · speaker 2-8 ဦး
Filler words
ထားရှိ (လိုအပ်ပါက ပိတ်)
Export
DOCX · SRT · timestamped TXT

Accuracy · real-world numbers

per-track WAV ပေါ်တွင် 97%+ ။ WAV သည် recognizer ကို အရှင်းကြည်လင်ဆုံး signal ပေးသည်။

WAV သည် raw PCM ကို perceptual compression မပါဘဲ သိမ်းဆည်းသောကြောင့် consonants နှင့် sibilants များကို MP3 ကဲ့သို့ smear မလုပ်ပါ။ Recognizer သည် microphone ကြားသည့်အရာကို ကြားသည်။ အောက်ပါ ဂဏန်းများသည် production အတွင်း customer WAV jobs အမှန်တကယ်များမှ ရရှိသည်။

98%
Studio WAV · တစ်ဦးတည်း speaker

48 kHz / 24-bit, large-diaphragm condenser, treated room။ Narration, audiobook, voice-over bookings များ ဤနေရာတွင် ပါဝင်သည်။

96%
Multi-track interview WAV

Speaker တစ်ဦးလျှင် channel တစ်ခု (lavs သို့မဟုတ် boundary mics)။ Diarization သည် channel routing သာ — text-only error။

92%
Handheld field recorder

Zoom H5, Tascam DR-40, ဆင်တူ ပစ္စည်းများ။ Stereo XY pickup, speakers 2-3 ဦး, အခန်းတွင်း ပြန်ဟပ်မှု အနည်းငယ်။ Podcast WAV အများစုသည် ဤနေရာတွင် ပါဝင်သည်။

85%
ဆူညံသော ဝန်းကျင် field WAV

အပြင်ဘက်၊ café, ယာဉ်တွင်း။ Lossless capture က ကူညီသည် — ဆူညံသံသည် တကယ်ဖြစ်နေသည် codec artefact မဟုတ် — သို့သော် ထပ်နေသော စကားပြောမှုပေါ်တွင် တိကျမှု ကျသွားနေဆဲ။

မေးခွန်းများ

လူများ မေးတတ်သော အရာ ၈ ခု။ WAV transcription အကြောင်း

01WAV ဖိုင်အရွယ်အစား အများဆုံး ဘယ်လောက်လဲ?+
Standard plan တွင် ဖိုင်တစ်ခုလျှင် 5 GB — stereo 48 kHz / 24-bit ဖြစ်ပါက ခန့်မှန်းခြေ 8 နာရီ, သို့မဟုတ် 96 kHz / 24-bit ဖြစ်ပါက 2.5 နာရီ။ ပိုကြီးသော ဖိုင်များကို team plan တွင် ရပါသည် — upload မလုပ်မီ ဆက်သွယ်ပါ။
02Zoom F-series သို့မဟုတ် MixPre မှ 32-bit float WAV ကို ထောက်ပံ့ပါသလား?+
ဟုတ်ပါသည်၊ မူရင်းအတိုင်း။ Float samples များကို 0 dBFS တွင် clip မဖြတ်ဘဲ ဖတ်ပါသည် — ထို့ကြောင့် post တွင် ဆွဲချရန် စီစဉ်ထားသော ကျယ်လောင်သော transients များကိုပင် သန့်ရှင်းစွာ transcribe လုပ်နိုင်သည်။ Generic uploaders အများစုသည် 16-bit သို့ တိတ်တိတ်ဆိတ်ဆိတ် down-cast လုပ်ပစ်ကြသည်။
03field recorder မှ 4-channel WAV ရှိသည် — လူတစ်ဦးလျှင် mic တစ်ခု။ Diarization က ၎င်းကို သုံးပါမည်လား?+
သုံးပါမည်။ Polyphonic WAV ကို တိုက်ရိုက် upload တင်ပါ (stereo သို့ ဦးစွာ bounce မလုပ်ပါနှင့်)။ WAV header မှ channel layout ကို parse လုပ်ပြီး track တစ်ခုလျှင် speaker တစ်ဦး သတ်မှတ်ပါသည် — အသံတူသူများပေါ်တွင် acoustic diarization ထက် များစွာ ယုံကြည်ရသည်။
04ကျွန်ုပ်၏ 96 kHz WAV ကို downsample လုပ်ပါမည်လား?+
Recognizer သည် အတွင်းတွင် 16 kHz ဖြင့် အလုပ်လုပ်သည် — ၎င်းသည် လူ့စကားပြောမှု ကြားနိုင်စွမ်း၏ အမြင့်ဆုံးကန့်သတ်ချက်ဖြစ်သည်။ သို့သော် မူရင်းဖိုင်ကို မထိဘဲ ထားရှိပြီး noise gating ကဲ့သို့ post-processing များအတွက် အသုံးပြုပါသည်။ သင်၏ exports များသည် မူရင်း timeline ကို ရည်ညွှန်းပါသည်။
05Transcription အတွက် WAV သည် MP3 ထက် တကယ်တိကျသလား?+
အနည်းငယ်တိကျသည် — ပုံမှန် clean speech တွင် WER 1-2 မှတ်ခန့်။ ပိုကြီးသော ကွာဟမှုသည် sibilants နှင့် တိုးတိုးသော အပိုင်းများတွင် ပေါ်လာသည် — MP3 ၏ psychoacoustic compression သည် recognizer သုံးနိုင်သော အချက်အလက်များကို ပစ်ပယ်လိုက်သည်။ Archival သို့မဟုတ် forensic အလုပ်အတွက် WAV သည် မှန်ကန်သော ရွေးချယ်မှု ဖြစ်သည်။
06BWF metadata နှင့် timecode ကို ထိန်းသိမ်းပါသလား?+
BWF chunks (bext, iXML) ကို ဖတ်ပြီး start timecode ကို သုံးကာ transcript ကို သင်၏ session timeline နှင့် ချိန်ညှိပါသည်။ မူရင်း WAV ကို ဘယ်တော့မှ မပြောင်းပါ — 24h အတွင်း ဖျက်ပစ်မည့် copy ပေါ်တွင်သာ အလုပ်လုပ်သည်။
07DAW session export မှ WAV ဖိုင် folder တစ်ခု drop လုပ်နိုင်ပါသလား?+
ဟုတ်။ Batch upload သည် တစ်ကြိမ်လျှင် ဖိုင် 50 အထိ လက်ခံပါသည်။ WAV တစ်ခုစီသည် ၎င်း၏ ကိုယ်ပိုင် job နှင့် transcript ရရှိသည်။ session တစ်ခုတည်းမှ stems များဆိုလျှင် upload မလုပ်မီ multi-track WAV တစ်ခုထဲသို့ ပေါင်းပြီး channel တစ်ခုစီအတွက် diarize လုပ်ပေးပါမည်။
081 နာရီ stereo WAV တစ်ခု အမှန်တကယ် ဘယ်လောက်ကြာသလဲ?+
Upload က အနှေးဆုံးအပိုင်း — 1 နာရီ 48 kHz / 24-bit stereo WAV သည် ခန့်မှန်းခြေ 600 MB ဖြစ်ပြီး ပုံမှန် broadband တွင် 2-5 မိနစ်ကြာသည်။ Upload ပြီးပါက standard queue တွင် transcription ကိုယ်တိုင်က ခန့်မှန်းခြေ 4-6 မိနစ်အတွင်း ပြီးပါသည်။

သင်၏ WAV ကို drop လုပ်ပါ။ Lossless အရည်အသွေးကို ထိန်းသိမ်းပါ။ ထွက်လာသည့်အရာကို ကြည့်ပါ။

လစဉ် မိနစ် 30 အခမဲ့။ Card မလို။ Per-track diarization, 32-bit float ထောက်ပံ့, source audio ကို 24h အတွင်း ဖျက်။

အခမဲ့ စတင်ပါ