Otter Pro
Limita ficheiros longos a 4 horas por gravación. As etiquetas de parlante quedan irregulares despois dos 2 minutos.
Solta un ficheiro de audio longo — ata 10 horas, 5 GB en Business. Segmentamos en paralelo, mantemos os IDs de parlante consistentes de extremo a extremo e devolveches un transcripto en lugar dunha carpeta numerada.
↓ Un ficheiro de 5 horas, no medio da transcripción
A maioría de ferramentas caduca arredor dos 90 minutos ou divide o teu gravación longa en parciais numeradas que tes que unir. Segmentamos en ventás sobrepostas de 12 minutos, procesamos en paralelo e reensamblamos cun paso de parlante global.
Levamos tres horas — volvamos á cuestión da cadea de subministración da sesión da mañá.
Certo, o xiro de fabricación en Vietnam. Creo que pasamos por alto o risco dos prazos de entrega.
Os prazos de entrega pasaron de 14 a 31 días despois da mudanza de aranceles.
E iso antes de contar a congestión portuaria en Long Beach.
↓ This is the dashboard
Same layout as the real dashboard — Summary, full Transcript, Speakers tab, Exports. Key points and action items extracted automatically. Auto-tags on every job.
Sample preview from a founder interview about post-call workflow. Real transcripts look exactly like this — same tabs, same summary block, same key-points / action-items split, same auto-tag chips.
Tres opcións reais · comparación honesta
As ferramentas de consumo limitan a duración do ficheiro e truncan en silencio. Whisper API ten un límite de 25 MB por solicitude, así que ti constrúes o segmentador. Aceptamos o ficheiro completo de 10 horas e devolveches un transcripto.
Limita ficheiros longos a 4 horas por gravación. As etiquetas de parlante quedan irregulares despois dos 2 minutos.
10 horas por ficheiro. Segmentación en paralelo, paso de parlante global, un DOCX de saída.
Máis barato por minuto. Ti constrúes o segmentador, a unión de parlantes e a lóxica de reintentos.
Os precios e límites son precisos a partir de maio de 2026. O límite de duración de Otter Pro verificouse por última vez na súa páxina de prezo público.
Específico para ficheiros longos
A maioría de pipelines construíronse para reunións dun hora. O audio longo rómpeas de formas predecibles — aquí está o que facemos diferente.
Solta calquera cousa por riba de 90 minutos e estas actívanse automaticamente. Anula por traballo desde o formulario.
Accuracy · real-world numbers
O difícil coa audio longa non é o modelo — é manter a precisión plana desde o minuto 1 ata o minuto 600. A desviaciónn de parlante e os erros de límite de fragmento son o que matan a maioría de pipelines. Os números seguintes mídense en ficheiros de clientes de duración completa, non só nos primeiros 10 minutos.
Narración de audiolibro, podcast individual, manuscrito ditado. 6-10 horas de voz limpa sen ruído ambiental. Non se precisa diarización.
Mesa de conferencia, micrófono decente, 3-5 horas. O paso de parlante global mantén os IDs estables en todo o ficheiro.
Día de formación de 7-9 horas con transferencia de micrófono e preguntas do público. Os nomes precisan un paso de 5 minutos nos chips de parlante.
Historia oral longa, grupo focal ou panel con voces sobrepostas e ruído ambiental. Usable, pero espera limpeza.
Preguntas comúns
30 minutos gratis cada mes. Sen tarxeta. Ficheiros ata 10 horas, etiquetas de parlante que permanecen consistentes, exportación de ficheiro único.
Comeza gratuitamente