Transcribeer lange audiobestanden.Tot 10 uur. Geen timeout.

Drop een lang audiobestand — tot 10 uur, 5 GB op Business. We verdelen parallel, houden sprekeridentificatie consistent van begin tot eind, en geven je één transcript in plaats van een genummerde map.

Sleep je audio of video erin

MP3 · WAV · M4A · MP4 · MOV · MKV · OGG · OPUS · FLAC · WEBM — up to 100 MB anonymously

Paste a link, we’ll fetch the audio

YouTube · TikTok · Vimeo · Twitter · SoundCloud · Spotify · 50+ more

Opnemen direct vanuit je browser

Aanmelden duurt 30 seconden — opnemen kan direct daarna, in het dashboard.

No card required~90s per 60-min fileSRT · VTT · DOCX · TXTBestanden worden binnen 24u automatisch verwijderd

↓ Een bestand van 5 uur, halftrans

Uren erin. Één schoon bestand eruit.

De meeste tools hebben timeout rond de 90-minuutgrens of splitsen je lange opname in genummerde delen die je zelf moet naaien. We gebruiken overlappende vensters van 12 minuten, verwerken ze parallel, en stellen ze opnieuw samen met een globale sprekersdoorgang.

Strategische bestuurssessieREC 3 sprekers · 5:14:22 · 3,1 GB
auto-detected en-GB44.1 kHz stereo · 192 kbps
~90s
Transcript · enkel bestand92% nauwkeurigheid · t=3:14:08
S1

We zijn drie uur ver — laten we teruggaan naar het punt over de toeleveringsketen uit de ochtendvergadering.

S2

Klopt, de pivot naar fabrikage in Vietnam. Ik denk dat we het risico van doorlooptijd hebben ondergespeeld.

S1

Doorlooptijden gingen van 14 naar 31 dagen na de tariefverandering.

S3

En dat is nog voordat we de congestie in de haven van Long Beach meenemen.

92% over het volledige bestand van 5uDOCX · SRT · TXT · JSON

↓ This is the dashboard

This is what loads when the job finishes.

Same layout as the real dashboard — Summary, full Transcript, Speakers tab, Exports. Key points and action items extracted automatically. Auto-tags on every job.

Try it on your own file — it's free

Drie echte opties · eerlijke vergelijking

Otter Pro. DIY Whisper chunking. Of ons.

Consumententools beperken bestandlengte en kappen rond af zonder waarschuwing. Whisper API heeft een plafond van 25 MB per verzoek, dus build je de chunker zelf. Wij accepteren het hele bestand van 10 uur en geven één transcript terug.

Option 01

Otter Pro

Beperkt lange bestanden tot 4 uur per opname. Sprekerslabels verschuiven na het 2-urs-punt.

Maximale bestandlengte4 uur (Pro-niveau)
Maximale bestandgrootte~1,5 GB upload
Sprekeridentificatie van begin tot eindVerschuift na 2 uur
Uitvoer voor lange bestandenEnkel document, afgekapt op limiet
Kosten$16,99/gebruiker/maand
Hervatbare uploadNee
Best forKorte vergaderingen onder 2 uur. Faalt bij opnamen voor de hele dag.
Option 02

Transcription.Solutions

10 uur per bestand. Parallel verdelen, globale sprekersdoorgang, één DOCX eruit.

Maximale bestandlengte10 uur (Pro & Business)
Maximale bestandgrootte2 GB Pro · 5 GB Business
Sprekeridentificatie van begin tot eindGlobale embedding-doorgang
Uitvoer voor lange bestandenEnkel bestand · DOCX/SRT/TXT
Kosten · per minuut$0,03 vast ongeacht lengte
Hervatbare uploadMultipart, blijft behouden bij druppels
Best forWorkshops voor een hele dag, deposities, bestuursvergaderingen, mondelinge geschiedenissen — alles voorbij de 90-minuutgrens.
Option 03

Whisper API + DIY chunking

Goedkoopst per minuut. Je bouwt de chunker, de sprekersnaaier, en de herhalinglogica.

Maximale bestandlengte25 MB per verzoek (~25 min)
Maximale bestandgrootte25 MB harde limiet
Sprekeridentificatie van begin tot eindGeen — geen diarisatie
Uitvoer voor lange bestandenGenummerde delen, je naaît zelf
Kosten · per minuut$0,006 (OpenAI Whisper)
EngineeringtijdUren tot dagen per pipeline
Best forIngenieurs die ruwe tekst per chunk willen en geen sprekerslabels, samenvattingen of één uitvoer nodig hebben.

Prijzen en limieten nauwkeurig per mei 2026. Otter Pro lengtelimiet laatst geverifieerd op hun publieke prijspagina.

Specifiek voor lange bestanden

Drie manieren waarop generieke tools falen voorbij de 90-minuutgrens.

De meeste pipelines zijn gebouwd voor eenuurvergaderingen. Lange audio breekt ze op voorspelbare manieren — hier is wat wij anders doen.

Wat gaat fout

  1. 1Stille timeout na 90 minuten. De taak draait een uur lang, sterft dan zonder nuttige fout. Je hebt niets om opnieuw te proberen.
  2. 2Sprekeridentificatie drijft tussen chunks. Spreker 1 in uur 1 wordt Spreker 4 in uur 3 omdat elke chunk geïsoleerd wordt gediariseerd.
  3. 3Uitvoer is een genummerde map. `transcript_part_01.txt` tot `transcript_part_24.txt` met timestamp-resets op elk chunkgrens. Je naaît het zelf.

Wat flip je hier

  1. 1Hervatbare multipart-upload. Verbinding valt uit in uur 2 van upload? Herneemt vanaf het laatst afgeronde deel. Geen herupload van 4 GB.
  2. 2Globale sprekerembedding-doorgang. Na diarisatie per chunk clusteren we stemmen over het hele bestand zodat Spreker 3 dezelfde persoon is op minuut 12 en minuut 487.
  3. 3Enkel DOCX met uurmarkeringen. Één bestand, continue tijdstempels, optionele kopbreuk elke 60 minuten. Geen naaien.

Aanbevolen taakinstellingen voor lange bestanden

Zet alles over 90 minuten en deze schakelen automatisch in. Override per taak vanaf het formulier.

Chunk-strategie
12 min vensters · 10s overlap
Diarisatie
Globale doorgang over alle chunks
Sprekermodel
Lange vorm · 2-20 sprekers
Upload
Hervatbare multipart
Wachtrij
Prioriteit (Business-plan)
Export
Enkel DOCX · uurmarkeringen aan

Accuracy · real-world numbers

92% houdt stand over een bestand van 5 uur. Kwaliteit blijft stabiel uur voor uur.

Het moeilijkste bij lange audio is niet het model — het is nauwkeurigheid stabiel houden van minuut 1 tot minuut 600. Sprekersverschuiving en grensfouten bij chunks zijn wat de meeste pipelines doodmaakt. Nummers hieronder zijn gemeten over totale klantbestanden, niet alleen de eerste 10 minuten.

95%
Studio lange vorm, enkele spreker

Audioboeknaratie, solopodcast, gedicteerd manuscript. 6-10 uur schone stem zonder achtergrondgeluid. Geen diarisatie nodig.

92%
Bestuurskamer, 2-6 sprekers

Conferentietafel, fatsoenlijke microfoon, 3-5 uur. Globale sprekersdoorgang houdt ID's stabiel over het hele bestand.

88%
Workshop voor hele dag, microfoonjes

7-9 uur trainingsdag met microfoonoverdrachten en publieksvragen. Namen hebben een 5-minuutdoorgang nodig op de sprekerchips.

82%
Veldrondetafel, 8+ sprekers

Lange mondelinge geschiedenis, focusgroep, of panel met overlappende stemmen en omgevingsgeluid. Bruikbaar, maar verwacht opschoning.

Veelgestelde vragen

8 dingen die mensen vragen over lange audiotranscriptie.

01Wat zijn de werkelijke limieten voor bestandlengte en -grootte?+
10 uur per bestand op zowel Pro als Business. Pro beperkt bestandgrootte tot 2 GB, Business tot 5 GB. Als je iets langer dan 10 uur hebt, split het eens op een natuurlijke breuk — we houden sprekeridentificatie consistent als je ze opeenvolgend op hetzelfde project upload.
02Krijg ik één transcript of een map met genummerde delen?+
Één bestand. Altijd. DOCX, SRT, TXT, of JSON — jouw keuze. Tijdstempels lopen continu van 00:00:00 tot het einde van de opname, niet reset op elk chunkgrens.
03Hoe lang duurt het voordat een bestand van 6 uur terug is?+
Ongeveer 18-25 minuten in de Pro-wachtrij, 8-12 in Business-prioriteit. We verwerken de 12-minuutchunks parallel, dus wandklokktijd schaal sub-lineair met bestandlengte, niet minuut per minuut.
04Blijven sprekeridentificaties consistent van begin tot eind?+
Ja. Na diarisatie per chunk clustert een globale embedding-doorgang stemmen over het hele bestand. Spreker 3 op minuut 12 is dezelfde Spreker 3 op minuut 487. Dit is het belangrijkste wat DIY Whisper-pipelines fout doen.
05Wat gebeurt er als mijn upload uitvalt in uur 3 van een bestand van 4 GB?+
Hervatbare multipart-upload pikt op waar het laatst afgeronde deel stopt. Je laadt de eerste 3 GB niet opnieuw. Werkt op onbetrouwbare hotelwifi en cellulaire tethering — we hebben beide getest.
06Waarom stikt de Whisper API bij lange bestanden?+
Het Whisper-eindpunt van OpenAI heeft een harde limiet van 25 MB per verzoek — ongeveer 25 minuten gecomprimeerde audio. Alles langer vergt dat jij chunks, transcribeert parallel, en dan transcripten naaît en sprekers zelf uitlijnt. We doen dat alles server-side.
07Is de prijs per minuut gelijk voor een bestand van 10 uur als voor een bestand van 10 minuten?+
Ja. $0,03 per minuut vast, ongeacht lengte. Een bestand van 10 uur kost $18. We berekenen geen extra voor lange bestanden zoals Rev doet ($1,50/min menselijk × 10 uur = $900).
08Kan ik voethoofdstukken of tijdstempels elk uur krijgen?+
Schakel 'Uurmarkeringen' in op het taakformulier en de DOCX-export met een kopbreuk elke 60 minuten. SRT houdt continue timecode. JSON heeft beide — chapter array plus woord-niveau tijdstempels.

Drop je lange bestand. Krijg één transcript terug.

30 gratis minuten per maand. Geen creditcard. Bestanden tot 10 uur, sprekerslabels die consistent blijven, export met enkel bestand.

Gratis starten