Transkribeer MP3 na teks.Sprekeretikette, 100+ tale.

Plaas 'n MP3-lêer teen enige bitkoers van 64 tot 320 kbps. Kry 'n tydgestempel, spreker-geetiketteerde uitskrif in 99 tale — geen formaatomskakeling, geen herenkodeer, geen wagry.

Plaas jou klank of video

MP3 · WAV · M4A · MP4 · MOV · MKV · OGG · OPUS · FLAC · WEBM — up to 100 MB anonymously

Paste a link, we’ll fetch the audio

YouTube · TikTok · Vimeo · Twitter · SoundCloud · Spotify · 50+ more

Neem direk vanuit jou blaaier op

Aanmelding neem 30 sekondes — opname maak reg daarna oop, in die dashboard.

No card required~90s per 60-min fileSRT · VTT · DOCX · TXTLêers verdwyn outomaties oor 24u

↓ Kyk wat uitkom

MP3 in. Diariseringsuitskrif uit.

Ons lees die MP3-raamkoppeë direk — VBR, CBR, joint-stereo, enige enkodeerder (LAME, Fraunhofer, FFmpeg). As die lêer ware stereo is met sprekers op aparte kanale, gebruik ons dit om stemme te verdeel. Mono-saamvoeg val terug op akoestiese diarisering.

interview-tape-04.mp3REC 192 kbps · stereo · 38:42
outomaties bespeur en-GB44.1 kHz · LAME 3.100
~90s
Uitskrif · streaming95% akkuraatheid
S1

So wanneer het jy eers besef dat die argief onvolledig was?

S2

Waarskynlik rondom 2019, toe ons die spoele begin digitaliseer het.

S1

En die verlore bande — was hulle enige plek in die katalogus aangedui?

S2

Daar is 'n papierindeks uit '78, maar die helfte daarvan is waterbeskadigd.

95% op 192 kbps stereoSRT · DOCX · TXT · JSON · VTT

↓ This is the dashboard

This is what loads when the job finishes.

Same layout as the real dashboard — Summary, full Transcript, Speakers tab, Exports. Key points and action items extracted automatically. Auto-tags on every job.

Try it on your own file — it's free

Drie werklike opsies · eerlike vergelyking

Gratis plaaslike Whisper. Otter of Sonix. Of ons.

Jy kan Whisper gratis op jou eie skootrekenaar loop as jy tegnies. Otter en Sonix aanvaar MP3-opladings binne intekendasiedashborde. Ons neem die lêer, gee die uitskrif terug, en dwing jou nie om binne 'n KI te lewe.

Option 01

Whisper plaaslik / oopbron

Gratis as jy 'n GPU en 'n middag het. Geen spreker-diarisering uit die doos.

OpstelPython + CUDA + 10 GB-modelle
Spreker-diariseringNie ingesluit (pyannote add-on)
Spoed · 1 uur MP35–40 min op verbruiker GPU
Tale99, maar klein model daal onder 80%
UitvoerTXT / SRT / VTT / JSON
KosteGratis + jou elektrisiteit
Best forIngenieurs wat reeds 'n GPU besit, geen sprekeretikette nodig het nie, en volledige plaaslike privaatheid wil.
Option 02

Transcription.Solutions

Plaas die MP3. Kry spreker-geetiketteerde teks terug in ongeveer realties × 0,025.

OpstelSleep-en-los, geen rekening nodig om te probeer
Spreker-diariseringIngebou (Pro & Business-planne)
Spoed · 1 uur MP3~90 sekondes
Tale99, outomaties bespeur
UitvoerSRT · VTT · DOCX · TXT · JSON
Koste · per min$0,03
Best forEnigiemand met 'n MP3 — joernalis-band, podkasguitvoer, stemlêer, argivale dub — wat net akkurate teks aan die ander kant wil.
Option 03

Otter / Sonix

Glansvolle dashboard, maandelikse minutehoofletters, Engels-ingestel. Lêeroplaading voel soos 'n syfeature.

OpstelRekening + betaalde plan
Spreker-diariseringAkoesties, EN-leunend
Spoed · 1 uur MP35–10 min in tou
TaleOtter EN-alleen; Sonix ~40
UitvoerGesluit agter betaalde vlakke
Koste$17+/mnd of $10+/uur (Sonix)
Best forSpanne wat 'n uitskrifredigeerder en samewerkings-KI meer wil hê as 'n skoon API-styl lêer→teks-vloei.

Pryse en funksionele beskikbaarheid akkuraat soos van Mei 2026. Whisper-prestasie wissel per modelgrootte en hardeware.

Spesifiek vir MP3

Drie dinge wat jou by generiese transkriptie-gereedskap kan vang.

MP3 is 'n formaat, nie 'n opnamestyl — wat beteken die mislukkingsmodusse kom van die enkodeerder, nie die spraak.

Wat gaan verkeerd

  1. 1VBR-koppeë word misgeparseer. Party gereedskap lees veranderlike-bitkoers-MP3s as vaste-koers en berekenverduur verkeerd — tydstempels vervang deur minute oor 'n uurlange lêer.
  2. 2Joint-stereo word afgeplat na mono tydens opladings-voorbewerking. Jy verloor die per-spreker-kanaalskeiding wat werklik in die lêer was.
  3. 3Ingebedde ID3-albumkuns knyp 'n paar oplaaders — hulle verwerp die lêer as 'nie suiwer oudio' of stroop dit en herenkodeer, wat kwaliteit verder verlies.

Wat ons doen in plaas daarvan

  1. 1Ons gebruik die Xing/LAME-koppeë wanneer dit teenwoordig is en raamtelling-terugval wanneer nie. VBR-tydstempels bly akkuraat tot ±0,1 s oor multi-uur-lêers.
  2. 2Joint-stereo en ware-stereo-MP3s word dekodeer na L/R PCM voor diarisering. As jou sprekers was gepan, hou ons hulle verdeel.
  3. 3ID3v1, ID3v2, APE-etikette, ingebedde kuns — alles ongewyzig deurverwys. Ons herenkodeer jou MP3 nooit.

Aanbevole jobtingstellings vir MP3-opladings

Verstekke wat ~80% van MP3-lêers pas. Negeer per-taak van die vorm.

Dekodeerder
Raamakkuraat, geen herenkodeer
Diarisering
Kanaalsplitsing as stereo, anders akoesties
Sprekermodel
Outomaties · 1-12 sprekers
Taal
Outomaties-bespeur van eerste 30 s
Vullwoorde
Verwyder (toggle om te behou)
Uitvoerbundel
DOCX + SRT + tydgestempelde TXT

Accuracy · real-world numbers

95%+ op 192 kbps stereo. Bruikbaar tot 64 kbps mono.

MP3-akkuraatheid word gebegrens deur wat die enkodeerder behou het, nie deur ons. Persepsie-kompressie bo ~96 kbps behou spraakbegrifpheid baie goed; onder 64 kbps, sibilante en medekinkers begin oplos. Nommers hieronder is van werklike klant-MP3s in produksie.

96%
320 kbps stereo, studiobron

Byna verliesvry vir spraak. Podkas-basMasters, dikteerassistent-uitvoere, professionele onderhoudingsstelle. Diarisering skoon as sprekers op aparte kanale.

95%
192 kbps stereo, 2-3 sprekers

Heel algemene bitkoers vir gesproke-woord-MP3s. Zoom-uitvoere, Riverside-aflaadings, stemrekorder-verstek. Komprimeringartifakte onhoorbaar vir herkenner.

91%
128 kbps mono, gesprek

Stemlêer-verstekke op meeste fone. Akoestiese diarisering hanteer 2-4 sprekers. Nommers en eienname benodig soms 'n blik.

84%
64 kbps mono, argivaal / foon-dump

Ou beantwoorder-masjien-aftake, voordragte-argiewe, nouband-bronne. Hoëfrekwensie-medekinkers (f/s/sh) vervloei. Steeds leesbaar — beplan 'n regdeurlesing.

Algemene vrae

8 dinge wat mense vra oor MP3-transkriptie.

01Wat is die minimum MP3-bitkoers wat steeds 'n bruikbare uitskrif gee?+
64 kbps is die praktiese vloer. Onder dit, sibilante (s, sh, f) komprimeer in ruis en woordfoutkoers klim bo 20%. As jy vars opneem, teiken 128 kbps mono of 192 kbps stereo — enigiets hoër is overkill vir spraak.
02Moet ek my MP3 eers na WAV omskakel?+
Nee. Herenkodeer MP3 → WAV voeg nul akkuraatheid by omdat die data wat die enkodeerder weggooi permanent weg is. Laai die MP3 direk op. Ons dekodeer rame in geheue en voer PCM na die herkenner.
03Sal stereo-MP3 my beter sprekeretikette gee as mono?+
Slegs as die sprekers werklik op aparte kanale opgeneem is — meeste stereo-MP3s het dieselfde oudio aan albei sye ('dual mono') en wins niks. Ware kanaalsplitsing (bv. Riverside-uitvoere, twee-mikrofoon-veldstellings) laat ons akoestiese diarisering skip en sprekeretikette naby-perfek gee.
04Wat is die maksimum MP3-lêergrootte wat jy aanvaar?+
5 GB per oplaading, wat ongeveer 60 uur teen 192 kbps of 90 uur teen 128 kbps is. As jou lêer groter is, sal ons gesegmenteerde oplaading toon — geen nodigheid om ditself te verdeel.
05Hoe lank duur dit om 'n 60-minuut-MP3 te transkribeer?+
Tipies 90 sekondes van oplaading-voltooi tot uitskrif-gereed, ongeag bitkoers. Dekodeer MP3-rame is vinnig; die tyd is in die herkenner. Diarisering voeg 5-10 sekondes by op multi-spreker-lêers.
06My MP3 het agtergrondmusiek — sal die uitskrif bederf word?+
Stil bedmusiek onder spraak is mooi. Luid musiek wat met die stem meeding (introstingers, telling onder onderhoude) lokkies soms misgherkennings op oorvleuelende lettergrepe uit. Skakel musiekonderdrukking aan die jobtvorlening in om voor te filter.
07Kan jy MP3s hanteer wat van foonstemelêer of antwoordtoestelle geskeur is?+
Ja, alhoewel hierdie dikwels 8 kHz nouband-herenkodeer as MP3 — die oudio-kwaliteitplafond word deur die oorspronklike PSTN-vangstelling ingestel, nie die MP3-omhulsel. Verwag 78-85% akkuraatheid op daardie soort bron, wat dieselfde is wat ons op die onderliggende oproep sou kry.
08Hou jy my MP3 nadat die uitskrif klaar is?+
Lêers word standaard na 30 dae verwyder, of onmiddellik op versoek via die dashboard. Die uitskrif bly in jou rekening tot jy dit verwyder. Ons gebruik geen klant-oudio om enige model op te train — ooit nie.

Plaas jou MP3. Kry teks terug in 90 sekondes.

30 gratis minute elke maand. Geen kaart vereis. Sprekeretikette, 99 tale, elke uitvoerformaat ingesluit.

Begin gratis