Transkriber MP3 til tekst.Talerlabeler, 100+ språk.

Slipp en MP3-fil ved hvilken som helst bitrate fra 64 til 320 kbps. Få en tidsstemplet, taleretiketert utskrift på 99 språk — ingen formatkonvertering, ingen re-koding, ingen venting i kø.

Slipp lyden eller videoen din her

MP3 · WAV · M4A · MP4 · MOV · MKV · OGG · OPUS · FLAC · WEBM — up to 100 MB anonymously

Paste a link, we’ll fetch the audio

YouTube · TikTok · Vimeo · Twitter · SoundCloud · Spotify · 50+ more

Ta opp rett fra nettleseren

Registrering tar 30 sekunder – opptak åpnes rett etterpå, i dashbordet.

No card required~90s per 60-min fileSRT · VTT · DOCX · TXTFiler slettes automatisk etter 24t

↓ Se hva som kommer ut

MP3 inn. Diarisert utskrift ut.

Vi leser MP3-rammehoder direkte — VBR, CBR, joint-stereo, enhver koder (LAME, Fraunhofer, FFmpeg). Hvis filen er ekte stereo med talere på separate kanaler, bruker vi det til å dele stemmer. Mono-nedmiksing faller tilbake på akustisk diarisering.

interview-tape-04.mp3REC 192 kbps · stereo · 38:42
auto-oppdaget en-GB44,1 kHz · LAME 3.100
~90s
Utskrift · streaming95% nøyaktighet
S1

Så når oppdaget du først at arkivet var ufullstendig?

S2

Sannsynligvis rundt 2019, da vi begynte å digitalisere rullene.

S1

Og de manglende båndene — var de katalogisert noe sted i det hele tatt?

S2

Det finnes en papirindeks fra '78, men halvparten er vanneskrapt.

95% på 192 kbps stereoSRT · DOCX · TXT · JSON · VTT

↓ This is the dashboard

This is what loads when the job finishes.

Same layout as the real dashboard — Summary, full Transcript, Speakers tab, Exports. Key points and action items extracted automatically. Auto-tags on every job.

Try it on your own file — it's free

Tre reelle alternativer · ærlig sammenligning

Gratis lokal Whisper. Otter eller Sonix. Eller oss.

Du kan kjøre Whisper på din egen bærbare datamaskinen gratis hvis du er teknisk anlagt. Otter og Sonix godtar MP3-opplastinger inne i abonnementsdashbord. Vi tar filen, gir deg utskriften, og gjør deg ikke avhengig av å jobbe inne i et UI.

Option 01

Whisper lokal / åpen kilde

Gratis hvis du har en GPU og en ettermiddag. Ingen talerdiarisering ut av boksen.

OppsettPython + CUDA + 10 GB modeller
TalerdiariseringIkke inkludert (pyannote add-on)
Hastighet · 1 time MP35–40 min på forbruker-GPU
Språk99, men liten modell faller under 80%
EksportTXT / SRT / VTT / JSON
KostnadGratis + din elektrisitet
Best forIngeniører som allerede eier en GPU, ikke trenger talerlabeler, og vil ha fullstendig lokal personvern.
Option 02

Transcription.Solutions

Slipp MP3. Få taleretiketert tekst tilbake på omtrent sanntid × 0,025.

OppsettDra-og-slipp, ingen konto nødvendig for å prøve
TalerdiariseringInnebygd (Pro- og Business-planer)
Hastighet · 1 time MP3~90 sekunder
Språk99, auto-oppdaget
EksportSRT · VTT · DOCX · TXT · JSON
Kostnad · per min$0,03
Best forAlle med en MP3 — journalistbånd, podkasteksport, talememo, arkivdubbing — som bare vil ha nøyaktig tekst på andre siden.
Option 03

Otter / Sonix

Polert dashboard, månedlig minuttergrense, engelsk-tunet. Filopplestsing føles som en bieffekt.

OppsettKonto + betalt plan
TalerdiariseringAkustisk, EN-orientert
Hastighet · 1 time MP35–10 min i kø
SpråkOtter EN-only; Sonix ~40
EksportLåst bak betalte nivåer
Kostnad$17+/mnd eller $10+/time (Sonix)
Best forTeam som vil ha en transkriptskriver og samarbeids-UI mer enn en ren API-stil fil→tekst-flyt.

Priser og funksjonstilgjengelighet nøyaktig fra mai 2026. Whisper ytelse varierer etter modellstørrelse og maskinvare.

Spesifikk for MP3

Tre ting som kan være problematisk med generiske transkripsjonsverktøy.

MP3 er et format, ikke en opptaksstil — som betyr at feiltilstandene kommer fra kodekern, ikke fra talen.

Hva som går galt

  1. 1VBR-hodinger blir mis-tolket. Noen verktøy leser variable-bitrate MP3-er som fast-rate og miscalculates varighet — tidsstempel driver avveie av minutter over en time-lang fil.
  2. 2Joint-stereo blir flatet til mono under opplastingsforhåndsbehandling. Du mister per-taler kanalseperasjon som faktisk var i filen.
  3. 3Innebygd ID3-albumkunst getter noen opplastere — de avviser filen som 'ikke ren lyd' eller fjerner den og re-koderer, og dropper kvaliteten ytterligere.

Hva vi gjør i stedet

  1. 1Vi bruker Xing/LAME-hodingen når den er tilstede og rammeantall-tilbakefall når den ikke er det. VBR-tidsstempel forblir nøyaktige til ±0,1 s over flere-times-filer.
  2. 2Joint-stereo og true-stereo MP3-er blir dekodet til L/R PCM før diarisering. Hvis dine talere var panned, beholder vi dem split.
  3. 3ID3v1, ID3v2, APE-tegg, innebygd kunst — alt passert gjennom uendret. Vi re-koderer aldri din MP3.

Anbefalte jobbinnstillinger for MP3-opplastinger

Standard som passer ~80% av MP3-filene. Overstyr per jobbe fra skjemaet.

Dekoder
Rammenøyaktig, ingen re-koding
Diarisering
Kanalsplitt hvis stereo, ellers akustisk
Talermodell
Auto · 1–12 talere
Språk
Auto-oppdaget fra første 30 s
Fyllerord
Fjernet (skru på for å beholde)
Eksportbundel
DOCX + SRT + tidsstemplet TXT

Accuracy · real-world numbers

95%+ på 192 kbps stereo. Brukbar helt ned til 64 kbps mono.

MP3-nøyaktighet er begrenset av hva kodekern beholdt, ikke av oss. Perceptuell kompresjon over ~96 kbps bevarer taleintelleligibilitet veldig godt; under 64 kbps, starter sibiliteter og konsonanter å løse opp. Tallene nedenfor er fra virkelige kunde-MP3-er i produksjon.

96%
320 kbps stereo, studiokilde

Nær-tapsfritt for tale. Podkastmastere, diktat-appeksporter, profesjonelle intervjuoppsett. Diarisering ren hvis talere på separate kanaler.

95%
192 kbps stereo, 2–3 talere

Vanligste bitrate for talte MP3-er. Zoom-eksporter, Riverside-nedlastinger, taleregistrering standard. Kompresjonartefakter uhørbare for gjengjenkjenner.

91%
128 kbps mono, samtalestil

Talememo-standard på de fleste telefoner. Akustisk diarisering håndterer 2–4 talere. Tall og egenavn trenger av og til et blikk.

84%
64 kbps mono, arkivering / telefondump

Gamle telefonsvarer-rippinger, forelesningsarkiver, smalbandskilder. Høyfrekvenkonsonanter (f/s/sh) blir uklare. Fortsatt lesbar — planlegg korrekturlesing.

Vanlige spørsmål

8 ting mennesker spør om MP3-transkripsjon.

01Hva er minimum MP3-bitrate som fortsatt gir en brukbar utskrift?+
64 kbps er den praktiske gulvet. Under det, sibiliteter (s, sh, f) komprimeres til støy og ordfeiltakst klatrer forbi 20%. Hvis du opptak fremt, målrette 128 kbps mono eller 192 kbps stereo — alt over det er overkill for tale.
02Trenger jeg å konvertere min MP3 til WAV først?+
Nei. Re-koding MP3 → WAV legger null nøyaktighet til fordi dataene kodekern forkastet er borte for godt. Last opp MP3-en direkte. Vi dekoder rammer i minnet og mater PCM til gjengjenkjenneren.
03Vil stereo MP3 gi meg bedre talerlabeler enn mono?+
Bare hvis talere faktisk ble spilt inn på separate kanaler — de fleste stereo-MP3-er har samme lyd på begge sider ('dual mono') og får ingenting. True channel-split (f.eks. Riverside-eksporter, tomic-feltrigger) lar oss hoppe over akustisk diarisering og merke talere nær-perfekt.
04Hva er maksimal MP3-filstørrelse du godtar?+
5 GB per opplasting, som er omtrent 60 timer på 192 kbps eller 90 timer på 128 kbps. Hvis filen din er større viser vi en chunked opplasting — ingen grunn til å dele den selv.
05Hvor lang tid tar en 60-minutters MP3 å transkribere?+
Typisk 90 sekunder fra opplasting-fullførte til utskrift-klar, uavhengig av bitrate. Dekoding av MP3-rammer er rask; tiden er i gjengjenkjenneren. Diarisering legger til 5–10 sekunder på flere-taler-filer.
06Min MP3 har bakgrunnsmusikk — blir utskriften ødelagt?+
Stille musikk under tale er fin. Høy musikk som konkurrerer med stemmen (intro-stinger, scoring under intervjuer) utløser noen ganger misgjenkjennelser på overlappende stavelser. Slå på musikkundertrykking på jobbskjemaet for å forfiltrere.
07Kan du håndtere MP3-er rippet fra telefonens talemail eller telefonsvarer?+
Ja, selv om disse ofte er 8 kHz smalband re-kodet som MP3 — lydkvaliteten tak er satt av det originale PSTN-oppfanget, ikke MP3-innpakningen. Forvent 78–85% nøyaktighet på den slags kilde, som er det samme vi ville få på den underliggende samtalen.
08Beholder du min MP3 etter at utskriften er ferdig?+
Filer slettes etter 30 dager som standard, eller umiddelbart på forespørsel via dashbordet. Utskriften forblir i din konto til du sletter den. Vi bruker ikke kundenlyd til å trene noen modell — noen gang.

Slipp din MP3. Få tekst tilbake på 90 sekunder.

30 gratis minutter hver måned. Ingen kort nødvendig. Talerlabeler, 99 språk, alle eksportformater inkludert.

Start gratis