Transkripsi file WAV dengan label pembicara.Kualitas lossless.

Letakkan rekaman WAV langsung dari rig lapangan, bounce DAW, atau kit wawancara Anda. Kami menjaga headroom 24-bit tetap utuh, menjalankan diarization pada PCM mentah, dan mengembalikan transkrip dengan stempel waktu dan SRT dalam hitungan menit.

Lepas audio atau video kamu di sini

MP3 · WAV · M4A · MP4 · MOV · MKV · OGG · OPUS · FLAC · WEBM — up to 100 MB anonymously

Paste a link, we’ll fetch the audio

YouTube · TikTok · Vimeo · Twitter · SoundCloud · Spotify · 50+ more

Rekam langsung dari browser

Pendaftaran cuma 30 detik — perekaman terbuka langsung setelahnya, di dashboard.

No card required~90s per 60-min fileSRT · VTT · DOCX · TXTFile hapus otomatis dalam 24 jam

↓ Lihat apa yang keluar

PCM mentah masuk. Transkrip bersih keluar.

WAV lossless berarti setiap sibilant, plosif, dan kata tenang selamat utuh — tanpa smear MP3 pada konsonan. Jika file adalah multi-track (satu pembicara per channel), kami melewati diarization akustik sepenuhnya dan membagi berdasarkan tata letak saluran.

WAV · 48 kHz / 24-bitREC 2 saluran · 1h 12m · 743 MB
auto-detected en-GBstereo PCM · tak terkompresi
~90s
Transkrip · streamingakurasi 97%
S1

Bawa saya kembali ke pagi hari tahun tujuh puluh delapan — jam berapa teleponnya masuk?

S2

Pukul empat lewat empat puluh lima, lebih atau kurang. Teko menyala, saya ingat itu.

S1

Dan dari sana Anda langsung berkendara ke pelabuhan?

S2

Langsung ke halaman perahu. Lampu masih menyala saat saya tiba.

97% pada WAV per-trackSRT · DOCX · TXT · JSON

↓ This is the dashboard

This is what loads when the job finishes.

Same layout as the real dashboard — Summary, full Transcript, Speakers tab, Exports. Key points and action items extracted automatically. Auto-tags on every job.

Try it on your own file — it's free

Tiga pilihan nyata · perbandingan jujur

Adobe Audition. Descript. Atau kami.

Fitur Speech to Text Audition disertakan dengan Creative Cloud dan tetap di dalam timeline. Descript mengimpor WAV ke editor sendiri. Kami mengambil file apa adanya, mengembalikan ekspor standar, dan tidak meminta Anda memindahkan proyek ke mana pun.

Option 01

Adobe Audition / Premiere

Panel transkrip di dalam timeline Adobe. Terikat pada Creative Cloud dan file proyek.

DiperlukanLangganan Creative Cloud
Diarization pembicaraYa, hanya campuran turun
Multi-track WAVDiratakan sebelum STT
EksporSRT · CSV · XML
Bahasa18, pilih manual
Biaya~$23/bulan (aplikasi tunggal)
Best forEditor yang sudah memotong di Premiere atau Audition yang menginginkan caption dijahit ke timeline.
Option 02

Transcription.Solutions

Letakkan WAV. Diarization per-channel jika multi-track. Sumber dihapus dalam 24h.

DiperlukanTidak ada — hanya file
Diarization pembicaraPer-track atau akustik
Multi-track WAVHingga 16 saluran
EksporSRT · VTT · DOCX · TXT · JSON
Bahasa99, auto-terdeteksi
Biaya · per menit$0.03
Best forSiapa pun yang memegang WAV mentah — perekam lapangan, podcaster yang bounce dari DAW, arsiparis sejarah lisan, peneliti.
Option 03

Descript

Mengimpor WAV Anda ke editor Descript. Powerful, tetapi Anda harus bekerja di dalamnya.

DiperlukanAkun Descript + impor
Diarization pembicaraAkustik, tuned EN
Multi-track WAVImpor sebagai clip terpisah
EksporTXT · SRT · DOCX
Bahasa23, akurasi bervariasi
Biaya$16–24/user/bulan
Best forEditor podcast yang ingin mengedit audio dengan mengedit transkrip — superpower Descript yang sebenarnya.

Harga akurat per 2026. Flag fitur Adobe dan Descript berubah sering; periksa dokumen terkini sebelum berkomitmen.

Spesifik untuk WAV

Tiga hal yang menggigit orang pada alat transkripsi generik.

Sebagian besar uploader diam-diam menurunkan sampel WAV Anda sebelum mengirimnya ke recognizer. Kami tidak.

Apa yang salah

  1. 1Multi-track WAV diratakan. Rekaman lapangan 4-saluran dari Sound Devices MixPre dicampur ke mono sebelum STT. Pemisahan per-mic yang Anda bayar dibuang.
  2. 2WAV float 32-bit dari seri Zoom F atau MixPre ditolak habis-habisan, atau dipotong menjadi 16-bit dan kehilangan pemulihan headroom mereka.
  3. 3Wawancara 96 kHz / 24-bit membutuhkan waktu selamanya untuk diunggah karena alat mengenkode ulang ke MP3 di browser sebelum mengirim.

Apa yang dibalik di sini

  1. 1Unggah multi-track WAV apa adanya (hingga 16 saluran). Kami membaca tata letak saluran dari header WAV dan menetapkan satu pembicara per trek — tanpa menebak akustik.
  2. 2Float 32-bit diterima secara native. Kami menjaga headroom float saat menormalkan untuk recognizer, sehingga puncak di atas 0 dBFS tidak terpotong.
  3. 3Unggah binary langsung, tanpa transcode di browser. WAV 2 GB bergerak dengan bandwidth penuh Anda dan mulai memproses saat byte terakhir mendarat.

Pengaturan pekerjaan yang direkomendasikan untuk WAV

Letakkan WAV dan pengaturan ini aktif secara default. Timpa per-pekerjaan dari formulir.

Tingkat sampel
Native (tanpa downsample)
Kedalaman bit
24-bit / 32-float terjaga
Diarization
Per-channel jika multi-track
Model pembicara
Wawancara · 2-8 pembicara
Kata pengisi
Dipertahankan (matikan jika diperlukan)
Ekspor
DOCX · SRT · TXT cap waktu

Accuracy · real-world numbers

97%+ pada WAV per-track. WAV memberi recognizer sinyal terbersih yang mungkin.

Karena WAV menyimpan PCM mentah tanpa kompresi perceptual, konsonan dan sibilant tidak dikeruhkan cara MP3 mengkeruhkannya. Recognizer mendengar apa yang didengar mikrofon. Angka di bawah berasal dari pekerjaan WAV pelanggan nyata dalam produksi.

98%
Studio WAV · pembicara tunggal

48 kHz / 24-bit, kondenser diafragma besar, ruangan bersuara. Narasi, audiobook, penempatan voice-over mendarat di sini.

96%
WAV wawancara multi-track

Satu saluran per pembicara (lavs atau mic batas). Diarization hanyalah routing saluran — kesalahan hanya teks.

92%
Perekam lapangan genggam

Zoom H5, Tascam DR-40, serupa. Pengambilan stereo XY, 2-3 pembicara, beberapa refleksi ruangan. Sebagian besar WAV podcast mendarat di sini.

85%
WAV lapangan lingkungan bising

Luar ruangan, kafe, kendaraan. Penangkapan lossless membantu — kebisingan itu nyata, bukan artefak codec — tetapi akurasi masih menurun pada ucapan tumpang tindih.

Pertanyaan umum

8 hal yang ditanyakan orang tentang transkripsi WAV.

01Berapa ukuran file WAV maksimal?+
5 GB per file dalam paket standar, yang kira-kira 8 jam stereo 48 kHz / 24-bit, atau 2,5 jam 96 kHz / 24-bit. File yang lebih besar baik-baik saja dalam paket tim — hubungi kami sebelum mengunggah.
02Apakah Anda mendukung WAV float 32-bit dari seri Zoom F atau MixPre?+
Ya, secara native. Kami membaca sampel float tanpa clipping pada 0 dBFS, jadi transien keras yang Anda rencanakan untuk ditarik dalam post masih ditranskrip dengan bersih. Sebagian besar uploader generik diam-diam menurunkan cast ke 16-bit lebih dulu.
03Saya memiliki WAV 4-saluran dari perekam lapangan — satu mic per orang. Apakah diarization akan menggunakan itu?+
Iya akan. Unggah WAV polifonik langsung (jangan bounce ke stereo lebih dulu). Kami mengurai tata letak saluran dari header WAV dan menetapkan satu pembicara per trek — jauh lebih andal daripada diarization akustik pada suara serupa.
04Apakah Anda akan menurunkan sampel WAV 96 kHz saya?+
Recognizer berjalan pada 16 kHz secara internal — itu batas kecerdasan ucapan manusia. Tetapi kami menjaga file asli Anda tetap utuh dan menggunakannya untuk pemrosesan pasca seperti gating kebisingan. Ekspor Anda mereferensikan timeline asli.
05Apakah WAV benar-benar lebih akurat daripada MP3 untuk transkripsi?+
Sedikit, ya — biasanya 1-2 poin WER pada ucapan bersih. Kesenjangan yang lebih besar muncul pada sibilant dan bagian senyap, di mana kompresi psychoacoustic MP3 membuang informasi yang akan digunakan recognizer. Untuk pekerjaan arsip atau forensik, WAV adalah pilihan yang tepat.
06Apakah metadata BWF dan timecode dipertahankan?+
Kami membaca chunk BWF (bext, iXML) dan menggunakan timecode awal untuk menyelaraskan transkrip ke timeline sesi Anda. WAV asli tidak pernah dimodifikasi — kami bekerja pada salinan yang dihapus dalam 24h.
07Bisakah saya melepas folder file WAV dari ekspor sesi DAW?+
Ya. Unggahan batch menerima hingga 50 file sekaligus. Setiap WAV mendapat pekerjaan dan transkrip sendiri. Jika itu dari satu sesi, Anda juga dapat menggabungkannya menjadi satu WAV multi-track sebelum mengunggah dan kami akan diarize per channel.
08Berapa lama waktu yang dibutuhkan untuk WAV stereo 1 jam?+
Unggahan adalah bagian terlamban — WAV stereo 48 kHz / 24-bit 1 jam sekitar 600 MB dan membutuhkan 2-5 menit pada broadband khas. Setelah diunggah, transkripsi itu sendiri berjalan dalam waktu sekitar 4-6 menit dalam antrian standar.

Letakkan WAV Anda. Pertahankan kualitas lossless. Lihat apa yang keluar.

30 menit gratis setiap bulan. Tanpa kartu. Diarization per-track, float 32-bit didukung, audio sumber dihapus dalam 24h.

Mulai gratis