Whisper setempat / sumber terbuka
Percuma jika anda mempunyai GPU dan petang. Tiada diarisasi pembicara secara terkunci.
Lepaskan fail MP3 pada kadar bit mana-mana dari 64 hingga 320 kbps. Dapatkan transkrip bertanda masa dengan label pembicara dalam 99 bahasa — tiada penukaran format, tiada pengekodan semula, tiada menunggu dalam giliran.
MP3 · WAV · M4A · MP4 · MOV · MKV · OGG · OPUS · FLAC · WEBM — up to 100 MB anonymously
YouTube · TikTok · Vimeo · Twitter · SoundCloud · Spotify · 50+ more
↓ Lihat apa yang keluar
Kami membaca tajuk bingkai MP3 secara langsung — VBR, CBR, stereo-bersama, pengenkod mana-mana (LAME, Fraunhofer, FFmpeg). Jika fail itu adalah stereo tulen dengan pembicara pada saluran berasingan, kami menggunakannya untuk membahagikan suara. Penurunan mono kembali ke diarisasi akustik.
Jadi bilakah anda sedar-akan bahawa arkib itu tidak lengkap?
Mungkin sekitar 2019, apabila kami mula mendigitalkan gulungan-gulungan.
Dan pita-pita yang hilang — adakah ia dicatat dalam katalog di mana-mana?
Ada indeks kertas dari '78, tetapi separuhnya rosak air.
↓ This is the dashboard
Same layout as the real dashboard — Summary, full Transcript, Speakers tab, Exports. Key points and action items extracted automatically. Auto-tags on every job.
Sample preview from a founder interview about post-call workflow. Real transcripts look exactly like this — same tabs, same summary block, same key-points / action-items split, same auto-tag chips.
Tiga pilihan nyata · perbandingan jujur
Anda boleh menjalankan Whisper pada komputer riba anda sendiri percuma jika anda teknikal. Otter dan Sonix menerima muat naik MP3 dalam papan pemuka langganan. Kami mengambil fail, mengembalikan transkrip, dan tidak membuat anda tinggal di dalam UI.
Percuma jika anda mempunyai GPU dan petang. Tiada diarisasi pembicara secara terkunci.
Lepaskan MP3. Dapatkan teks berlabel pembicara kembali dalam masa nyata kira-kira × 0.025.
Papan pemuka yang diperhalus, modal minit setiap bulan, dimasuki ke bahasa Inggeris. Muat naik fail terasa seperti ciri sampingan.
Harga dan ketersediaan ciri tepat setakat Mei 2026. Prestasi Whisper berbeza mengikut saiz model dan perkakasan.
Khusus untuk MP3
MP3 adalah format, bukan gaya rakaman — yang bermaksud mod kegagalan datang daripada pengenkod, bukan ucapan.
Lalai yang sesuai ~80% fail MP3. Ganti setiap pekerjaan daripada borang.
Accuracy · real-world numbers
Ketepatan MP3 dibatasi oleh apa yang disimpan oleh pengenkod, bukan oleh kami. Pemampatan persepsi di atas ~96 kbps mengekalkan kebolehtahanan ucapan dengan sangat baik; di bawah 64 kbps, sibilant dan konsonan mula larut. Nombor di bawah adalah daripada MP3 pelanggan nyata dalam pengeluaran.
Hampir tidak hilang untuk ucapan. Induk podcast, eksport aplikasi ujaran, ruang wawancara profesional. Diarisasi bersih jika pembicara pada saluran berasingan.
Kadar bit paling biasa untuk MP3 perkataan lisan. Eksport Zoom, muat turun Riverside, perakam suara lalai. Artifak pemampatan tidak dapat dilihat kepada pengiktiraf.
Memo suara lalai pada kebanyakan telefon. Diarisasi akustik mengendalikan 2-4 pembicara. Nombor dan nama watak kadang-kadang memerlukan pandangan.
Rips mesin jawab lama, arkib kuliah, sumber jalur sempit. Konsonan frekuensi tinggi (f/s/sh) kabur. Masih boleh dibaca — rancang proofread.
Soalan biasa
30 minit percuma setiap bulan. Tiada kad diperlukan. Label pembicara, 99 bahasa, setiap format eksport disertakan.
Mulai dengan percuma