Transcrire les fichiers WAV avec identification des locuteurs.Qualité sans perte.

Déposez un enregistrement WAV directement depuis votre configuration de terrain, votre export DAW ou votre kit d'interview. Nous conservons les 24 bits de réserve, exécutons la diarisation sur le PCM brut, et retournons une transcription horodatée avec SRT en quelques minutes.

Déposez votre audio ou vidéo

MP3 · WAV · M4A · MP4 · MOV · MKV · OGG · OPUS · FLAC · WEBM — up to 100 MB anonymously

Paste a link, we’ll fetch the audio

YouTube · TikTok · Vimeo · Twitter · SoundCloud · Spotify · 50+ more

Enregistrez directement depuis votre navigateur

L'inscription prend 30 secondes — l'enregistrement s'ouvre juste après, dans le tableau de bord.

No card required~90s per 60-min fileSRT · VTT · DOCX · TXTFichiers supprimés automatiquement sous 24h

↓ Regardez ce qui en sort

PCM brut en entrée. Transcription propre en sortie.

WAV sans perte signifie que chaque sibilante, occlusive et mot faible survivent intacts — aucun flou MP3 sur les consonnes. Si le fichier est multi-piste (un locuteur par canal), nous ignorons complètement la diarisation acoustique et séparons selon la disposition des canaux.

WAV · 48 kHz / 24 bitsREC 2 pistes · 1h 12m · 743 Mo
auto-detected en-GBstéréo PCM · non compressé
~90s
Transcription · streamingPrécision 97 %
S1

Ramène-moi à ce matin-là, en 78 — à quelle heure l'appel est arrivé?

S2

Vers cinq heures moins le quart, à peu près. La bouilloire était en train de chauffer, je me souviens.

S1

Et de là tu es allé droit au port?

S2

Directement au chantier naval. Les lumières étaient toujours allumées quand je suis arrivé.

97 % sur WAV par canalSRT · DOCX · TXT · JSON

↓ This is the dashboard

This is what loads when the job finishes.

Same layout as the real dashboard — Summary, full Transcript, Speakers tab, Exports. Key points and action items extracted automatically. Auto-tags on every job.

Try it on your own file — it's free

Trois vraies options · comparaison honnête

Adobe Audition. Descript. Ou nous.

Speech to Text d'Audition est fourni avec Creative Cloud et reste dans la timeline. Descript importe le WAV dans son propre éditeur. Nous prenons le fichier tel quel, retournons des exports standards, et ne vous demandons pas de déplacer votre projet.

Option 01

Adobe Audition / Premiere

Panneau de transcription dans la timeline Adobe. Lié à Creative Cloud et au fichier projet.

NécessiteAbonnement Creative Cloud
Diarisation des locuteursOui, mixé uniquement
WAV multi-pisteAplati avant STT
ExportSRT · CSV · XML
Langues18, sélection manuelle
Coût~23 $/mois (application unique)
Best forLes éditeurs qui travaillent déjà dans Premiere ou Audition et qui veulent des sous-titres attachés à la timeline.
Option 02

Transcription.Solutions

Déposez le WAV. Diarisation par canal s'il est multi-piste. Source supprimée en 24h.

NécessiteRien — juste le fichier
Diarisation des locuteursPar piste ou acoustique
WAV multi-pisteJusqu'à 16 canaux
ExportSRT · VTT · DOCX · TXT · JSON
Langues99, auto-détectées
Coût · par minute$0,03
Best forQuiconque travaille avec un WAV brut — enregistreurs de terrain, podcasteurs qui exportent d'une DAW, archivistes d'histoire orale, chercheurs.
Option 03

Descript

Importe votre WAV dans l'éditeur Descript. Puissant, mais vous devez travailler à l'intérieur.

NécessiteCompte Descript + import
Diarisation des locuteursAcoustique, optimisée EN
WAV multi-pisteImport en tant que clips séparés
ExportTXT · SRT · DOCX
Langues23, la précision varie
Coût$16–24/utilisateur/mois
Best forLes éditeurs de podcasts qui veulent éditer l'audio en éditant la transcription — le vrai superpouvoir de Descript.

Prix exacts en 2026. Les drapeaux de fonctionnalité d'Adobe et Descript changent fréquemment ; consultez la documentation actuelle avant de vous engager.

Spécifique à WAV

Trois choses qui posent problème aux gens avec les outils de transcription génériques.

La plupart des outils réduisent silencieusement votre WAV avant de l'envoyer à un moteur. Nous ne le faisons pas.

Ce qui s'en va mal

  1. 1Le WAV multi-piste est aplati. Un enregistrement 4 canaux depuis un Sound Devices MixPre est mixé en mono avant STT. La séparation par microphone pour laquelle vous avez payé est perdue.
  2. 2Les WAV 32 bits flottants depuis Zoom F-series ou MixPre sont rejetés directement, ou clipsés en 16 bits et perdent leur récupération de réserve.
  3. 3Les interviews 96 kHz / 24 bits prennent une éternité à télécharger parce que l'outil réencode en MP3 dans le navigateur avant d'envoyer.

Ce qu'il faut changer ici

  1. 1Téléchargez le WAV multi-piste tel quel (jusqu'à 16 canaux). Nous lisons la disposition des canaux à partir de l'en-tête WAV et assignons un locuteur par piste — aucune estimation acoustique.
  2. 2Le 32 bits flottant est accepté nativement. Nous préservons la réserve flottante lors de la normalisation pour le moteur, donc les pics au-dessus de 0 dBFS ne clipsent pas.
  3. 3Téléchargement binaire direct, pas de transcodage dans le navigateur. Un WAV de 2 Go se déplace à votre bande passante complète et commence à traiter dès l'arrivée du dernier octet.

Paramètres de travail recommandés pour WAV

Déposez un WAV et ces options s'activent par défaut. Remplacez par job depuis le formulaire.

Fréquence d'échantillonnage
Natif (pas de réduction)
Profondeur de bits
24 bits / 32 flottants préservés
Diarisation
Par canal si multi-piste
Modèle de locuteur
Interview · 2-8 locuteurs
Mots de remplissage
Conservés (désactiver si nécessaire)
Export
DOCX · SRT · TXT horodaté

Accuracy · real-world numbers

97 %+ sur WAV par canal. WAV offre au moteur de reconnaissance le signal le plus propre possible.

Parce que WAV stocke du PCM brut sans compression perceptuelle, les consonnes et les sibilantes ne sont pas étouffées comme le fait le MP3. Le moteur entend ce que le microphone a entendu. Les chiffres ci-dessous proviennent de vrais travaux WAV de clients en production.

98%
WAV studio · locuteur unique

48 kHz / 24 bits, microphone grande membrane, room traité. La narration, les audiobooks et les bookings voice-over arrivent ici.

96%
WAV d'interview multi-piste

Un canal par locuteur (lavallières ou microphones limite). La diarisation est juste du routage de canal — erreur texte uniquement.

92%
Enregistreur de terrain portatif

Zoom H5, Tascam DR-40, similaires. Captage stéréo XY, 2-3 locuteurs, certaines réflexions d'ambiance. La plupart des WAV podcast sont ici.

85%
WAV de terrain bruyant

Extérieur, café, véhicule. La capture sans perte aide — le bruit est réel, pas un artefact codec — mais la précision baisse toujours sur la parole chevauchante.

Questions courantes

8 choses que les gens demandent sur la transcription WAV.

01Quelle est la taille maximale d'un fichier WAV?+
5 Go par fichier sur le plan standard, ce qui représente environ 8 heures de stéréo 48 kHz / 24 bits, ou 2,5 heures de 96 kHz / 24 bits. Les fichiers plus volumineux conviennent au plan d'équipe — contactez-nous simplement avant le téléchargement.
02Prenez-vous en charge les WAV 32 bits flottants de Zoom F-series ou MixPre?+
Oui, nativement. Nous lisons les échantillons flottants sans clipage à 0 dBFS, donc les transitoires fortes que vous aviez prévu de réduire en post sont toujours transcrites clairement. La plupart des outils génériques réduisent silencieusement en 16 bits d'abord.
03J'ai un WAV 4 canaux depuis un enregistreur de terrain — un microphone par personne. La diarisation l'utilisera-t-elle?+
Elle l'utilisera. Téléchargez le WAV polyphonique directement (ne bouncerez pas vers la stéréo en premier). Nous analysons la disposition des canaux à partir de l'en-tête WAV et assignons un locuteur par piste — beaucoup plus fiable que la diarisation acoustique sur des voix similaires.
04Allez-vous réduire mon WAV 96 kHz?+
Le moteur fonctionne à 16 kHz en interne — c'est le plafond de l'intelligibilité vocale humaine. Mais nous gardons votre fichier d'origine intact et l'utilisons pour tout traitement post-production comme le noise gating. Vos exports respectent la timeline d'origine.
05Is WAV réellement plus précis que MP3 pour la transcription?+
Marginalement, oui — généralement 1-2 points de WER sur la parole propre. L'écart plus important apparaît sur les sibilantes et les passages silencieux, où la compression psychoacoustique du MP3 jette l'information que le moteur aurait utilisée. Pour l'archivage ou le travail légal, WAV est le bon choix.
06Les métadonnées BWF et le timecode sont-ils préservés?+
Nous lisons les chunks BWF (bext, iXML) et utilisons le timecode de démarrage pour aligner la transcription à votre timeline de session. Le WAV d'origine n'est jamais modifié — nous travaillons sur une copie supprimée dans les 24h.
07Puis-je déposer un dossier de fichiers WAV depuis un export de session DAW?+
Oui. Le téléchargement par lots accepte jusqu'à 50 fichiers à la fois. Chaque WAV obtient son propre travail et sa transcription. S'ils sont des stems d'une seule session, vous pouvez également les fusionner en un seul WAV multi-piste avant le téléchargement et nous diariserons par canal.
08Combien de temps un WAV stéréo d'1 heure prend-il réellement?+
Le téléchargement est la partie la plus lente — un WAV stéréo 48 kHz / 24 bits d'1 heure est environ 600 Mo et prend 2-5 minutes sur un broadband classique. Une fois téléchargé, la transcription elle-même s'exécute en environ 4-6 minutes sur la queue standard.

Déposez votre WAV. Conservez la qualité sans perte. Voyez ce qui en sort.

30 minutes gratuites chaque mois. Pas de carte. Diarisation par piste, 32 bits flottants supportés, audio source supprimé en 24h.

Commencer gratuitement