Transcribeer WAV-bestanden met sprekeraanduidingen.Lossless kwaliteit.

Sleep een WAV-opname rechtstreeks van je veldrek, DAW-bounce of interview-kit. We behouden de 24-bits headroom, draaien diarisering op het ruwe PCM, en leveren in minuten een transcript met tijdstempel en SRT.

Sleep je audio of video erin

MP3 · WAV · M4A · MP4 · MOV · MKV · OGG · OPUS · FLAC · WEBM — up to 100 MB anonymously

Paste a link, we’ll fetch the audio

YouTube · TikTok · Vimeo · Twitter · SoundCloud · Spotify · 50+ more

Opnemen direct vanuit je browser

Aanmelden duurt 30 seconden — opnemen kan direct daarna, in het dashboard.

No card required~90s per 60-min fileSRT · VTT · DOCX · TXTBestanden worden binnen 24u automatisch verwijderd

↓ Bekijk wat eruit komt

Ruw PCM erin. Schoon transcript eruit.

Lossless WAV betekent dat elk sibilant, plosief en zacht woord intact blijft — geen MP3-vervaging op medeklinkers. Als het bestand multi-track is (één spreker per kanaal), slaan we akoestische diarisering volledig over en splitsen we op de kanaallayout.

WAV · 48 kHz / 24-bitsREC 2 tracks · 1h 12m · 743 MB
auto-gedetecteerd en-GBstereo PCM · ongecomprimeerd
~90s
Transcript · streaming97% nauwkeurigheid
S1

Neem me mee terug naar die ochtend in '78 — hoe laat kwam het telefoontje?

S2

Vijf voor vijf, min of meer. De ketel stond aan, daar herinner ik me nog.

S1

En van daaruit ben je direct naar de haven gereden?

S2

Rechtstreeks naar de scheepswerf. De lampen waren nog aan toen ik binnenkwam.

97% bij WAV per trackSRT · DOCX · TXT · JSON

↓ This is the dashboard

This is what loads when the job finishes.

Same layout as the real dashboard — Summary, full Transcript, Speakers tab, Exports. Key points and action items extracted automatically. Auto-tags on every job.

Try it on your own file — it's free

Drie echte opties · eerlijke vergelijking

Adobe Audition. Descript. Of wij.

Audition's Speech to Text zit in Creative Cloud en blijft in de timeline. Descript importeert het WAV in zijn eigen editor. Wij nemen het bestand zoals het is, leveren standaardexports, en vragen niet om je project te verplaatsen.

Option 01

Adobe Audition / Premiere

Transcriptpaneel in de Adobe-timeline. Gebonden aan Creative Cloud en het projectbestand.

VereistCreative Cloud-abonnement
Spreker-diariseringJa, alleen gemengd
Multi-track WAVAfgeplat voor STT
ExportSRT · CSV · XML
Talen18, handmatig selecteren
Kosten~$23/mnd (enkelvoudige app)
Best forEditors die al in Premiere of Audition knippen en ondertitels in de timeline willen.
Option 02

Transcription.Solutions

Sleep het WAV. Per-kanaal diarisering bij multi-track. Bron verwijderd in 24h.

VereistNiets — alleen het bestand
Spreker-diariseringPer-track of akoestisch
Multi-track WAVTot 16 kanalen
ExportSRT · VTT · DOCX · TXT · JSON
Talen99, auto-gedetecteerd
Kosten · per minuut$0.03
Best forIedereen met een ruw WAV — veldrecorders, podcasters die van een DAW bounced, mondelinge-geschiedenisarchivarissen, onderzoekers.
Option 03

Descript

Importeert je WAV in de editor van Descript. Krachtig, maar je moet erin werken.

VereistDescript-account + import
Spreker-diariseringAkoestisch, EN-geoptimaliseerd
Multi-track WAVImporteren als afzonderlijke clips
ExportTXT · SRT · DOCX
Talen23, nauwkeurigheid varieert
Kosten$16–24/gebruiker/mnd
Best forPodcast-editors die audio willen bewerken door het transcript te bewerken — Descript's echte superkracht.

Prijzen correct per 2026. Adobe en Descript feature flags veranderen frequent; controleer actuele docs voor het vastleggen.

Specifiek voor WAV

Drie dingen die mensen in generieke transcriptietools tegen komen.

De meeste uploaders downsampling je WAV stilzwijgend voordat ze het naar een herkenner sturen. Wij niet.

Wat gaat fout

  1. 1Multi-track WAV wordt afgeplat. Een 4-kanaalopname van een Sound Devices MixPre wordt gemengd tot mono voor STT. De per-microfoon scheiding waar je voor betaald hebt, wordt weggegooid.
  2. 232-bits float WAVs van Zoom F-series of MixPre worden volledig afgewezen, of geclipd tot 16-bit en verliezen hun headroom-herstel.
  3. 396 kHz / 24-bits interviews duren eeuwig om te uploaden omdat het gereedschap opnieuw encodeert naar MP3 in de browser voordat het wordt verstuurd.

Wat hier anders

  1. 1Upload de multi-track WAV zoals het is (tot 16 kanalen). We lezen de kanaallayout uit de WAV-header en kennen één spreker per track toe — geen akoestisch giswerk.
  2. 232-bits float wordt natively ondersteund. We behouden de float headroom bij normalisering voor de herkenner, dus pieken boven 0 dBFS clippen niet.
  3. 3Direct binaire upload, geen transcode in de browser. Een 2 GB WAV beweegt op je volledige bandbreedte en begint te verwerken zodra de laatste byte binnenkomt.

Aanbevolen taakintstellingen voor WAV

Sleep een WAV en deze schakelen standaard in. Override per-job vanuit het formulier.

Samplefrequentie
Native (geen downsample)
Bitdiepte
24-bits / 32-float behouden
Diarisering
Per-kanaal als multi-track
Spreker model
Interview · 2-8 sprekers
Vulwoorden
Behouden (zet uit indien nodig)
Export
DOCX · SRT · timestamped TXT

Accuracy · real-world numbers

97%+ op per-track WAV. WAV geeft de herkenner het schoonste mogelijke signaal.

Omdat WAV ruw PCM opslaat zonder perceptuele compressie, blijven medeklinkers en sibilanten niet vervagd zoals MP3 dat doet. De herkenner hoort wat de microfoon hoorde. Getallen hieronder komen van echte klant-WAV-jobs in productie.

98%
Studio WAV · één spreker

48 kHz / 24-bits, condensatormicrofoon met groot membraan, behandelde ruimte. Naratie, audioboek, voice-over-boekingen landen hier.

96%
Multi-track interview WAV

Één kanaal per spreker (lavs of grensmicrofoons). Diarisering is alleen kanaalroutering — tekst-alleen fout.

92%
Draagbare veldrecorder

Zoom H5, Tascam DR-40, vergelijkbaar. Stereo XY pickup, 2-3 sprekers, enige kamerreflectie. De meeste podcast-WAVs landen hier.

85%
Lawaairijke omgeving veld-WAV

Buitenshuis, café, voertuig. Lossless capture helpt — het lawaai is echt, niet codecartefact — maar nauwkeurigheid daalt nog steeds bij overlappende spraak.

Veelgestelde vragen

8 vragen die mensen over WAV-transcriptie stellen.

01Wat is de maximale WAV-bestandsgrootte?+
5 GB per bestand op het standaardplan, wat ruwweg 8 uur stereo 48 kHz / 24-bits is, of 2,5 uur 96 kHz / 24-bits. Grotere bestanden gaan prima op het teamplan — neem alleen contact met ons op voor upload.
02Ondersteun je 32-bits float WAV van Zoom F-series of MixPre?+
Ja, natively. We lezen de float-samples zonder clipping op 0 dBFS, dus luid transients die je in post wilt terugbrengen, worden nog steeds schoon getranscribeerd. De meeste generieke uploaders casten stilzwijgend eerst tot 16-bit.
03Ik heb een 4-kanaal WAV van een veldrecorder — één microfoon per persoon. Zal diarisering dat gebruiken?+
Dat zal het. Upload het polyfone WAV rechtstreeks (niet eerst naar stereo bounced). We analyseren de kanaallayout uit de WAV-header en kennen één spreker per track toe — veel betrouwbaarder dan akoestische diarisering op soortgelijke stemmen.
04Zul je mijn 96 kHz WAV downsampling?+
De herkenner draait intern op 16 kHz — dat is het plafond van menselijke spraakintelligibiliteit. Maar we houden je originele bestand intact en gebruiken het voor post-processing zoals noise gating. Je exports verwijzen naar de originele timeline.
05Is WAV eigenlijk nauwkeuriger dan MP3 voor transcriptie?+
Marginaal, ja — meestal 1-2 punten WER op schone spraak. De grotere kloof verschijnt bij sibilanten en stille passages, waar MP3's psychoakoestische compressie informatie weggooit die de herkenner zou hebben gebruikt. Voor archief- of forensisch werk is WAV het juiste.
06Zijn BWF-metagegevens en timecode behouden?+
We lezen BWF-chunks (bext, iXML) en gebruiken de starttimecode om het transcript uit te lijnen met je sessiestijdlijn. Het originele WAV wordt nooit gewijzigd — we werken aan een kopie die binnen 24u wordt verwijderd.
07Kan ik een map WAV-bestanden van een DAW-sessie-export neerzetten?+
Ja. Batch upload accepteert tot 50 bestanden tegelijk. Elk WAV krijgt zijn eigen job en transcript. Als het stems van één sessie zijn, kun je ze ook samenvoegen tot een enkel multi-track WAV voor upload en we diariseer per kanaal.
08Hoe lang duurt eigenlijk een 1-uur stereo WAV?+
Upload is het langzaamste gedeelte — een 1-uur 48 kHz / 24-bits stereo WAV is ongeveer 600 MB en kost 2-5 minuten op typische breedbandverbinding. Eenmaal geüpload, draait transcriptie zelf in ongeveer 4-6 minuten in de standaardwachtrij.

Sleep je WAV. Behoud de lossless kwaliteit. Bekijk wat eruit komt.

30 gratis minuten elke maand. Geen kaart. Per-track diarisering, 32-bits float ondersteund, bronnaudio verwijderd in 24u.

Begin gratis