Transkripsi file audio panjang.Hingga 10 jam. Tanpa timeout.

Unggah file audio panjang — hingga 10 jam, 5 GB di Business. Kami melakukan chunking secara paralel, menjaga ID speaker konsisten dari awal hingga akhir, dan memberikan satu transkrip alih-alih folder bernomor.

Lepas audio atau video kamu di sini

MP3 · WAV · M4A · MP4 · MOV · MKV · OGG · OPUS · FLAC · WEBM — up to 100 MB anonymously

Paste a link, we’ll fetch the audio

YouTube · TikTok · Vimeo · Twitter · SoundCloud · Spotify · 50+ more

Rekam langsung dari browser

Pendaftaran cuma 30 detik — perekaman terbuka langsung setelahnya, di dashboard.

No card required~90s per 60-min fileSRT · VTT · DOCX · TXTFile hapus otomatis dalam 24 jam

↓ File 5 jam, pertengahan transkrip

Jam berlalu. Satu file bersih keluar.

Sebagian besar alat mengalami timeout sekitar menit ke-90 atau memisahkan rekaman panjang Anda menjadi parsial bernomor yang harus Anda jahit. Kami melakukan chunking di jendela tumpang tindih 12 menit, memprosesnya secara paralel, dan merakitnya kembali dengan pemeriksaan speaker global.

Sesi strategi dewanREC 3 pembicara · 5:14:22 · 3.1 GB
auto-terdeteksi en-GB44.1 kHz stereo · 192 kbps
~90s
Transkrip · file tunggalAkurasi 92% · t=3:14:08
S1

Kami sudah tiga jam — mari kita kembali ke poin rantai pasokan dari sesi pagi.

S2

Benar, perubahan manufaktur Vietnam. Saya pikir kami mengabaikan risiko waktu tunggu.

S1

Waktu tunggu berubah dari 14 menjadi 31 hari setelah perubahan tarif.

S3

Dan itu sebelum kami mempertimbangkan kemacetan pelabuhan di Long Beach.

92% di seluruh file 5 jamDOCX · SRT · TXT · JSON

↓ This is the dashboard

This is what loads when the job finishes.

Same layout as the real dashboard — Summary, full Transcript, Speakers tab, Exports. Key points and action items extracted automatically. Auto-tags on every job.

Try it on your own file — it's free

Tiga opsi nyata · perbandingan jujur

Otter Pro. DIY Whisper chunking. Atau kami.

Alat konsumen membatasi panjang file dan diam-diam memotong. Whisper API memiliki batas 25 MB per-permintaan, jadi Anda membangun chunker sendiri. Kami menerima seluruh file 10 jam dan mengembalikan satu transkrip.

Option 01

Otter Pro

Membatasi file panjang pada 4 jam per rekaman. Label speaker bergeser melewati menit ke-2 jam.

Panjang file maksimal4 jam (tier Pro)
Ukuran file maksimal~1.5 GB unggah
ID speaker dari awal hingga akhirBergeser melewati 2 jam
Output file panjangDokumen tunggal, dipotong pada batas
Biaya$16.99/pengguna/bulan
Unggah yang dapat dilanjutkanTidak
Best forRapat singkat di bawah 2 jam. Gagal pada rekaman seharian penuh.
Option 02

Transcription.Solutions

10 jam per file. Chunking paralel, pemeriksaan speaker global, satu DOCX keluar.

Panjang file maksimal10 jam (Pro & Business)
Ukuran file maksimal2 GB Pro · 5 GB Business
ID speaker dari awal hingga akhirPemeriksaan embedding global
Output file panjangFile tunggal · DOCX/SRT/TXT
Biaya · per menit$0.03 datar berapa pun panjangnya
Unggah yang dapat dilanjutkanMultipart, bertahan dari putus koneksi
Best forWorkshop seharian, deposisi, rapat dewan, sejarah lisan — apa pun yang melampaui dinding 90 menit.
Option 03

Whisper API + DIY chunking

Termurah per menit. Anda membangun chunker, jahitan speaker, dan logika pengulangan.

Panjang file maksimal25 MB per permintaan (~25 menit)
Ukuran file maksimalBatas keras 25 MB
ID speaker dari awal hingga akhirTidak ada — tanpa diarisasi
Output file panjangParsial bernomor, Anda jahit
Biaya · per menit$0.006 (OpenAI Whisper)
Waktu engineeringJam hingga hari per pipeline
Best forEngineer yang menginginkan teks mentah per chunk dan tidak memerlukan speaker, ringkasan, atau output tunggal.

Harga dan batas akurat per Mei 2026. Batas panjang Otter Pro terakhir diverifikasi di halaman harga publik mereka.

Khusus untuk file panjang

Tiga cara alat generik mati melewati menit ke-90.

Sebagian besar pipeline dibangun untuk rapat satu jam. Audio panjang memecahnya dengan cara yang dapat diprediksi — berikut adalah apa yang kami lakukan berbeda.

Yang salah

  1. 1Timeout senyap pada 90 menit. Pekerjaan berputar selama satu jam, lalu mati tanpa kesalahan yang berguna. Anda dibiarkan tanpa apa pun untuk mencoba ulang.
  2. 2ID speaker bergeser antar chunk. Speaker 1 di jam 1 menjadi Speaker 4 di jam 3 karena setiap chunk diarisasi secara terpisah.
  3. 3Output adalah folder bernomor. `transcript_part_01.txt` hingga `transcript_part_24.txt` dengan pengaturan ulang stempel waktu di setiap batas chunk. Anda menjahitnya sendiri.

Yang harus diubah di sini

  1. 1Unggah multipart yang dapat dilanjutkan. Koneksi putus di jam 2 unggahan? Lanjutkan dari bagian terakhir yang selesai. Tidak ada re-unggah 4 GB.
  2. 2Pemeriksaan embedding speaker global. Setelah diarisasi per-chunk, kami mengelompokkan suara di seluruh file sehingga Speaker 3 adalah orang yang sama pada menit 12 dan menit 487.
  3. 3DOCX tunggal dengan penanda jam. File tunggal, stempel waktu berkelanjutan, jeda bab opsional setiap 60 menit. Tanpa jahitan.

Pengaturan pekerjaan yang direkomendasikan untuk file panjang

Unggah apa pun di atas 90 menit dan ini aktif secara otomatis. Override per-pekerjaan dari formulir.

Strategi Chunk
Jendela 12 menit · tumpang tindih 10 detik
Diarisasi
Pemeriksaan global di semua chunk
Model speaker
Long-form · 2-20 pembicara
Unggah
Multipart yang dapat dilanjutkan
Antrian
Prioritas (paket Business)
Ekspor
DOCX tunggal · penanda jam aktif

Accuracy · real-world numbers

92% bertahan di seluruh file 5 jam. Kualitas tetap datar jam demi jam.

Bagian sulit dengan audio panjang bukan modelnya — itu menjaga akurasi tetap datar dari menit 1 hingga menit 600. Pergeseran speaker dan kesalahan batas chunk adalah apa yang membunuh sebagian besar pipeline. Angka di bawah diukur di seluruh file pelanggan sepanjang, bukan 10 menit pertama.

95%
Studio long-form, pembicara tunggal

Narasi audiobook, podcast solo, naskah yang didiktekan. 6-10 jam suara bersih tanpa bising ruang. Tidak perlu diarisasi.

92%
Ruang dewan, 2-6 pembicara

Meja konferensi, mikrofon yang layak, 3-5 jam. Pemeriksaan speaker global menjaga ID stabil di seluruh file.

88%
Workshop seharian, mikrofon kerah

Hari pelatihan 7-9 jam dengan serah mikrofon dan Q&A audiens. Nama memerlukan pemeriksaan 5 menit pada chip speaker.

82%
Meja bundar lapangan, 8+ pembicara

Sejarah lisan panjang, kelompok fokus, atau panel dengan suara yang tumpang tindih dan bising sekitar. Dapat digunakan, tetapi harapkan pembersihan.

Pertanyaan umum

8 hal yang ditanyakan orang tentang transkripsi audio panjang.

01Berapa batas panjang dan ukuran file sebenarnya?+
10 jam per file di Pro dan Business. Pro membatasi ukuran file pada 2 GB, Business pada 5 GB. Jika Anda memiliki sesuatu yang lebih lama dari 10 jam, pisahkan sekali pada istirahat alami — kami akan menjaga ID speaker konsisten jika Anda mengunggahnya berturut-turut di proyek yang sama.
02Apakah saya mendapatkan satu transkrip atau folder parsial bernomor?+
Satu file. Selalu. DOCX, SRT, TXT, atau JSON — pilihan Anda. Stempel waktu berjalan terus-menerus dari 00:00:00 hingga akhir rekaman, bukan disetel ulang di setiap batas chunk.
03Berapa lama file 6 jam kembali?+
Kira-kira 18–25 menit di antrian Pro, 8–12 di prioritas Business. Kami memproses chunk 12 menit secara paralel, jadi waktu dinding berskala sub-linear dengan panjang file, bukan menit demi menit.
04Apakah ID speaker tetap konsisten dari awal hingga akhir?+
Ya. Setelah diarisasi per-chunk, pemeriksaan embedding global mengelompokkan suara di seluruh file. Speaker 3 di menit 12 adalah Speaker 3 yang sama di menit 487. Ini adalah hal utama yang dipersalahkan pipeline DIY Whisper.
05Apa yang terjadi jika unggahan saya putus pada jam 3 dari file 4 GB?+
Unggah multipart yang dapat dilanjutkan melanjutkan dari bagian terakhir yang selesai. Anda tidak perlu mengunggah ulang 3 GB pertama. Bekerja pada Wi-Fi hotel yang tidak stabil dan tethering seluler — kami menguji keduanya.
06Mengapa Whisper API mogok pada file panjang?+
Titik akhir Whisper OpenAI memiliki batas keras 25 MB per-permintaan — kira-kira 25 menit audio terkompresi. Apa pun yang lebih lama memerlukan Anda untuk mengelompokkan, mentranskripsi secara paralel, lalu menjahit transkrip dan menyelaraskan speaker sendiri. Kami melakukan semua itu di sisi server.
07Apakah harga per menit sama pada file 10 jam seperti file 10 menit?+
Ya. $0.03 per menit datar, terlepas dari panjang. File 10 jam berharga $18. Kami tidak mengenakan biaya tambahan file panjang seperti yang dilakukan Rev ($1.50/menit manusia × 10 jam = $900).
08Bisakah saya mendapatkan penanda bab atau stempel waktu setiap jam?+
Alihkan 'Penanda jam' pada formulir pekerjaan dan ekspor DOCX dengan jeda tajuk setiap 60 menit. SRT menjaga timecode berkelanjutan. JSON memiliki keduanya — array bab plus stempel waktu level kata.

Unggah file panjang Anda. Dapatkan satu transkrip kembali.

30 menit gratis setiap bulan. Tanpa kartu. File hingga 10 jam, label speaker yang tetap konsisten, ekspor file tunggal.

Mulai gratis