Otter Pro
Limite les fichiers longs à 4 heures par enregistrement. Les étiquettes de locuteur dérivent après 2 heures.
Déposez un fichier audio long — jusqu'à 10 heures, 5 GB sur Business. Nous segmentons en parallèle, maintenons les ID de locuteur cohérents d'un bout à l'autre, et vous retournons une seule transcription au lieu d'un dossier numéroté.
MP3 · WAV · M4A · MP4 · MOV · MKV · OGG · OPUS · FLAC · WEBM — up to 100 MB anonymously
YouTube · TikTok · Vimeo · Twitter · SoundCloud · Spotify · 50+ more
↓ Un fichier de 5 heures, en cours de transcription
La plupart des outils expirent autour de 90 minutes ou divisent votre enregistrement long en éléments numérotés que vous devez assembler. Nous segmentons en fenêtres de 12 minutes chevauchantes, les traitons en parallèle, et les réassemblons avec une passe de locuteur global.
Nous en sommes à trois heures — revenons sur le point de la chaîne d'approvisionnement de la session du matin.
Exact, le pivot de fabrication au Vietnam. Je pense que nous avons sous-estimé le risque de délai de livraison.
Les délais de livraison sont passés de 14 à 31 jours après le changement tarifaire.
Et c'est avant de tenir compte de la congestion portuaire à Long Beach.
↓ This is the dashboard
Same layout as the real dashboard — Summary, full Transcript, Speakers tab, Exports. Key points and action items extracted automatically. Auto-tags on every job.
Sample preview from a founder interview about post-call workflow. Real transcripts look exactly like this — same tabs, same summary block, same key-points / action-items split, same auto-tag chips.
Trois vraies options · comparaison honnête
Les outils grand public limitent la longueur des fichiers et les tronquent silencieusement. L'API Whisper a un plafond de 25 MB par requête, donc vous construisez vous-même le segmenteur. Nous acceptons le fichier complet de 10 heures et retournons une seule transcription.
Limite les fichiers longs à 4 heures par enregistrement. Les étiquettes de locuteur dérivent après 2 heures.
10 heures par fichier. Segmentation parallèle, passe de locuteur global, un DOCX en sortie.
Le moins cher par minute. Vous construisez le segmenteur, l'assemblage des locuteurs et la logique de nouvelle tentative.
Tarification et limites exactes en mai 2026. Limite de longueur Otter Pro vérifiée en dernier sur leur page de tarification publique.
Spécifique aux fichiers longs
La plupart des pipelines ont été construits pour les réunions d'une heure. L'audio long les casse de manière prévisible — voilà ce que nous faisons différemment.
Déposez n'importe quoi au-delà de 90 minutes et ces paramètres s'activent automatiquement. Remplacez par travail à partir du formulaire.
Accuracy · real-world numbers
La partie difficile avec l'audio long n'est pas le modèle — c'est de maintenir la précision stable de la minute 1 à la minute 600. La dérive du locuteur et les erreurs aux limites des segments sont ce qui tue la plupart des pipelines. Les chiffres ci-dessous sont mesurés sur des fichiers clients de longueur complète, pas sur les 10 premières minutes.
Narration de livre audio, podcast solo, manuscrit dicté. 6-10 heures de voix claire sans bruit ambiant. Pas de diarisation nécessaire.
Table de conférence, son correct, 3-5 heures. La passe de locuteur global maintient les ID stables sur tout le fichier.
Journée de formation de 7-9 heures avec transferts de micro et questions-réponses du public. Les noms nécessitent une passe de 5 minutes sur les puces de locuteur.
Histoire orale longue, groupe de discussion, ou panel avec des voix qui se chevauchent et du bruit ambiant. Utilisable, mais attendez-vous au nettoyage.
Questions courantes
30 minutes gratuites chaque mois. Aucune carte. Fichiers jusqu'à 10 heures, étiquettes de locuteur qui restent cohérentes, exportation fichier unique.
Commencer gratuitement