Whisper lokal / open source
Gratis jika Anda punya GPU dan waktu luang setengah hari. Tidak ada diarisasi pembicara dari kotak.
Letakkan file MP3 pada bitrate apa saja dari 64 hingga 320 kbps. Dapatkan transkripsi dengan cap waktu dan label pembicara dalam 99 bahasa — tanpa konversi format, tanpa pengkodean ulang, tanpa menunggu antrian.
MP3 · WAV · M4A · MP4 · MOV · MKV · OGG · OPUS · FLAC · WEBM — up to 100 MB anonymously
YouTube · TikTok · Vimeo · Twitter · SoundCloud · Spotify · 50+ more
↓ Lihat hasil yang keluar
Kami membaca header frame MP3 langsung — VBR, CBR, joint-stereo, encoder apa pun (LAME, Fraunhofer, FFmpeg). Jika file adalah stereo asli dengan pembicara di saluran terpisah, kami menggunakannya untuk memisahkan suara. Penurunan mono kembali ke diarisasi akustik.
Jadi kapan Anda pertama kali menyadari arsip tidak lengkap?
Mungkin sekitar 2019, ketika kami mulai mendigitalkan reel-to-reel.
Dan kaset yang hilang — apakah mereka dikatalogkan di mana saja?
Ada indeks kertas dari '78, tapi setengahnya rusak air.
↓ This is the dashboard
Same layout as the real dashboard — Summary, full Transcript, Speakers tab, Exports. Key points and action items extracted automatically. Auto-tags on every job.
Sample preview from a founder interview about post-call workflow. Real transcripts look exactly like this — same tabs, same summary block, same key-points / action-items split, same auto-tag chips.
Tiga pilihan nyata · perbandingan jujur
Anda dapat menjalankan Whisper di laptop Anda sendiri gratis jika Anda teknis. Otter dan Sonix menerima unggahan MP3 di dalam dashboard berlangganan. Kami mengambil file, mengembalikan transkripsi, dan tidak membuat Anda hidup di dalam UI.
Gratis jika Anda punya GPU dan waktu luang setengah hari. Tidak ada diarisasi pembicara dari kotak.
Letakkan MP3. Dapatkan teks berlabel pembicara kembali dalam waktu nyata × 0,025.
Dashboard yang dipoles, batas menit bulanan, disetel untuk bahasa Inggris. Unggahan file terasa seperti fitur sampingan.
Harga dan ketersediaan fitur akurat per Mei 2026. Kinerja Whisper bervariasi menurut ukuran model dan perangkat keras.
Khusus untuk MP3
MP3 adalah format, bukan gaya perekaman — yang berarti mode kegagalan berasal dari enkoder, bukan ucapan.
Default yang sesuai ~80% file MP3. Timpa per-pekerjaan dari formulir.
Accuracy · real-world numbers
Akurasi MP3 dibatasi oleh apa yang disimpan enkoder, bukan oleh kami. Kompresi persepsi di atas ~96 kbps mempertahankan kecerdasan ucapan dengan sangat baik; di bawah 64 kbps, sibilant dan konsonan mulai larut. Angka di bawah ini dari MP3 pelanggan nyata dalam produksi.
Hampir bebas kehilangan untuk ucapan. Master podcast, ekspor aplikasi dikto, rig wawancara profesional. Diarisasi bersih jika pembicara di saluran terpisah.
Bitrate paling umum untuk MP3 spoken-word. Ekspor Zoom, unduhan Riverside, standar perekam suara. Artefak kompresi tidak terdengar oleh pengenal.
Voice memo default pada sebagian besar ponsel. Diarisasi akustik menangani 2-4 pembicara. Angka dan nama diri kadang-kadang membutuhkan pandangan.
Rips mesin penjawab lama, arsip kuliah, sumber narrow-band. Konsonan frekuensi tinggi (f/s/sh) blur. Masih dapat dibaca — rencanakan proofread.
Pertanyaan umum
30 menit gratis setiap bulan. Tidak perlu kartu. Label pembicara, 99 bahasa, setiap format ekspor disertakan.
Mulai gratis