ffmpeg + Whisper
Gratuit, local, mais peu commode. Vous possédez le pipeline et tous les bugs qu'il contient.
Déposez le fichier MP4 tel quel — nous extrayons la piste audio côté serveur, retournons une transcription horodatée et livrons un SRT qui s'intègre directement dans YouTube, Vimeo ou votre NLE.
MP3 · WAV · M4A · MP4 · MOV · MKV · OGG · OPUS · FLAC · WEBM — up to 100 MB anonymously
YouTube · TikTok · Vimeo · Twitter · SoundCloud · Spotify · 50+ more
↓ Regardez ce qui en sort
MP4 est un conteneur — nous lisons le flux audio directement, sans jamais réencoder la vidéo. Les horodatages restent précis à l'image par rapport à votre chronologie d'origine, donc le SRT s'aligne dès la première importation.
D'accord, dans ce module nous parcourons le flux de remboursement de bout en bout.
Question rapide avant de commencer — cela s'applique-t-il aussi aux remboursements partiels ?
Bonne remarque. Les partiels utilisent le même écran mais un code de raison différent.
Compris. Et le seuil d'approbation est toujours de deux cents dollars ?
↓ This is the dashboard
Same layout as the real dashboard — Summary, full Transcript, Speakers tab, Exports. Key points and action items extracted automatically. Auto-tags on every job.
Sample preview from a founder interview about post-call workflow. Real transcripts look exactly like this — same tabs, same summary block, same key-points / action-items split, same auto-tag chips.
Trois vraies options · comparaison honnête
Vous pouvez extraire l'audio vous-même et lancer Whisper. Vous pouvez glisser le MP4 dans Descript ou VEED et rester dans leur éditeur. Ou vous pouvez déposer le fichier ici et récupérer la transcription + SRT, sans dépendre d'un éditeur.
Gratuit, local, mais peu commode. Vous possédez le pipeline et tous les bugs qu'il contient.
Déposez le MP4. Extraction audio, diarisation, SRT, résumé — une seule passe.
Chargez le MP4 dans l'éditeur. La transcription apparaît comme faisant partie de l'interface de la chronologie.
Les tarifs et les limites de fonctionnalités sont approximatifs en 2026. Les noms de forfait Descript et VEED changent fréquemment — consultez leur site pour les limites actuelles.
Spécifique à MP4
MP4 est un conteneur, pas un codec — et la plupart des outils de transcription le traitent comme un gros blob audio. C'est là que les erreurs viennent.
Déposez un MP4 et ceux-ci s'activent par défaut. Remplacez-les au besoin dans le formulaire.
Accuracy · real-world numbers
La précision MP4 est fixée par le micro, pas par le codec. Un microphone cravate sur un plateau calme surpasse une caméra 4K avec audio embarqué à chaque fois. Les chiffres ci-dessous proviennent de véritables MP4 clients, triés par ce qui captait l'audio.
Cravate ou perche vers un enregistreur, AAC 48 kHz à 192+ kbps, pièce traitée. Le meilleur cas. Les étiquettes de locuteur fonctionnent bien en prise à deux personnes.
Micro sur la caméra à 2–4 pieds du locuteur. Un peu de bruit ambiant mais la parole est intelligible. La plupart des contenus de créateurs YouTube aboutissent ici.
Exports OBS, Loom, Camtasia. Le micro est proche mais la pièce est non traitée, souvent avec fuite d'audio système. Très convenable pour les transcriptions de tutoriel.
Micro de téléphone intégré, bruit de vent ou de manipulation, distance variable plan à plan. Mots utilisables, attendez-vous à 1–2 corrections par minute sur les noms propres.
Questions fréquentes
30 minutes gratuites chaque mois. Pas de carte. Audio extrait côté serveur, étiquettes de locuteur, SRT précis à l'image — tout compris.
Commencer gratuitement