Otter Pro
Limita arxius llargs a 4 hores per gravació. Les etiquetes de parlant es desviuen després de la marca de 2 hores.
Carrega un arxiu d'àudio llarg — fins a 10 hores, 5 GB en Business. Dividim en paral·lel, mantenim les IDs de parlants consistents de principi a fi, i retornem una única transcripció en lloc d'una carpeta numerada.
MP3 · WAV · M4A · MP4 · MOV · MKV · OGG · OPUS · FLAC · WEBM — up to 100 MB anonymously
YouTube · TikTok · Vimeo · Twitter · SoundCloud · Spotify · 50+ more
↓ Un arxiu de 5 hores, a meitat de la transcripció
La majoria d'eines s'estallen al voltant de la marca de 90 minuts o divideixen la teva gravació llarga en parcials numerats que has de cosir. Dividim en finestres solapades de 12 minuts, les processem en paral·lel i les reassemblem amb una passada global de parlant.
Portem tres hores — tornem al tema de la cadena de subministrament de la sessió del matí.
Clar, el gir de la manufactura a Vietnam. Crec que vam passar per alt el risc de temps de lliurament.
Els temps de lliurament van passar de 14 a 31 dies després del canvi d'aranzels.
I això és abans de tenir en compte la congestió portuària a Long Beach.
↓ This is the dashboard
Same layout as the real dashboard — Summary, full Transcript, Speakers tab, Exports. Key points and action items extracted automatically. Auto-tags on every job.
Sample preview from a founder interview about post-call workflow. Real transcripts look exactly like this — same tabs, same summary block, same key-points / action-items split, same auto-tag chips.
Tres opcions reals · comparació honesta
Les eines de consum limiten la longitud dels arxius i els trunquen silenciosament. L'API de Whisper té un límit de 25 MB per sol·licitud, així que tu construeixes el divisor. Acceptem tot l'arxiu de 10 hores i retornem una única transcripció.
Limita arxius llargs a 4 hores per gravació. Les etiquetes de parlant es desviuen després de la marca de 2 hores.
10 hores per arxiu. Chunking paral·lel, passada de parlant global, un DOCX de sortida.
Més barat per minut. Tu construeixes el divisor, la costura de parlant i la lògica de reintent.
Preus i límits precisos a partir de maig de 2026. Límit de longitud de Otter Pro verificat per última vegada a la seva pàgina de preus públics.
Específic per a arxius llargs
La majoria de pipelines es van construir per a reunions d'una hora. L'àudio llarg els trenca de maneres previsibles — aquí és el que fem diferent.
Deixa qualsevol cosa més de 90 minuts i aquestes es canvien automàticament. Anul·la per treball des del formulari.
Accuracy · real-world numbers
La part difícil amb l'àudio llarg no és el model — és mantenir la precisió plana del minut 1 al minut 600. La deriva de parlant i els errors als límits de chunks són els que maten la majoria de pipelines. Els números següents es mesuren en arxius de clients de longitud completa, no en els primers 10 minuts.
Narració d'audiollibre, podcast en solitari, manuscrit dictat. 6-10 hores de veu neta sense soroll de sala. No es necessita diarització.
Taula de conferència, micròfon decent, 3-5 hores. La passada de parlant global manté les ID estables en tot l'arxiu.
Dia de formació de 7-9 hores amb canvis de micròfon i preguntes i respostes públiques. Els noms necessiten una passada de 5 minuts en els xips de parlant.
História oral llarga, grup de discussió o panell amb veus solapades i soroll ambiental. Usable, però espera neteja.
Preguntes freqüents
30 minuts gratuïts cada mes. Sense targeta. Arxius fins a 10 hores, etiquetes de parlant que es mantenen consistents, exportació d'arxiu únic.
Comença gratis