Whisper lokal / open source
Gratis, hvis du har en GPU og en eftermiddag. Ingen taler-diarisering ud af boksen.
Slip en MP3-fil ved enhver bitrate fra 64 til 320 kbps. Få et tidsstemplet, taler-mærket manuskript på 99 sprog — ingen formatkonvertering, ingen genindkodning, ingen ventetid i kø.
MP3 · WAV · M4A · MP4 · MOV · MKV · OGG · OPUS · FLAC · WEBM — up to 100 MB anonymously
YouTube · TikTok · Vimeo · Twitter · SoundCloud · Spotify · 50+ more
↓ Se hvad der kommer ud
Vi læser MP3-rammehoveder direkte — VBR, CBR, joint-stereo, enhver encoder (LAME, Fraunhofer, FFmpeg). Hvis filen er ægte stereo med talere på separate kanaler, bruger vi det til at opdele stemmer. Mono mix-down falder tilbage til akustisk diarisering.
Så hvornår indså du først, at arkivet var ufuldstændigt?
Nok omkring 2019, da vi begyndte at digitalisere spoler.
Og de manglende bånd — blev de katalogiseret nogen steder?
Der er et papirindeks fra '78, men halvdelen er vandskade.
↓ This is the dashboard
Same layout as the real dashboard — Summary, full Transcript, Speakers tab, Exports. Key points and action items extracted automatically. Auto-tags on every job.
Sample preview from a founder interview about post-call workflow. Real transcripts look exactly like this — same tabs, same summary block, same key-points / action-items split, same auto-tag chips.
Tre rigtige muligheder · ærlig sammenligning
Du kan køre Whisper på din egen bærbare gratis, hvis du er teknisk. Otter og Sonix accepterer MP3-uploads inden for abonnementsdashboards. Vi tager filen, returnerer manuskriptet, og tvinger dig ikke til at leve inden i en UI.
Gratis, hvis du har en GPU og en eftermiddag. Ingen taler-diarisering ud af boksen.
Slip MP3-filen. Få taler-mærket tekst tilbage på cirka realtid × 0,025.
Poleret dashboard, månedligt minut-loft, engelsk-tunet. Fil-upload føles som en sidebemærkning.
Priser og funktionel tilgængelighed præcis som af maj 2026. Whisper-ydeevne varierer efter modelstørrelse og hardware.
Specifikt for MP3
MP3 er et format, ikke en optagelsestil — hvilket betyder, at fejltilstandene kommer fra encoderen, ikke fra talen.
Standard, der passer ~80% af MP3-filer. Tilknyt per-job fra formularen.
Accuracy · real-world numbers
MP3-nøjagtighed er afgrænset af hvad encoderen gemte, ikke af os. Perceptuel komprimering over ~96 kbps bevarer tale-intelligibilitet meget godt; under 64 kbps begynder sibylantser og konsonanter at opløses. Tallene nedenfor er fra rigtige kunde-MP3'er i produktion.
Næsten tabsfri for tale. Podcast-master, diktér-app-eksporter, professionelle interview-rig. Diarisering ren hvis talere på separate kanaler.
Mest almindelig bitrate for talte MP3'er. Zoom-eksporter, Riverside-downloads, stemmeoptagelsesstandard. Komprimerings-artefakter hørt for genkendelses ikke.
Voice memo-standard på de fleste telefoner. Akustisk diarisering håndterer 2-4 talere. Tal og egennavne kræver af og til et blik.
Gamle telefonsvarer-rip, forelæsningsarkiver, snævrband-kilder. Høj-frekvens konsonanter (f/s/sh) bliver uklare. Stadig læselig — plan en korrektion.
Almindelige spørgsmål
30 gratis minutter hver måned. Ingen kort påkrævet. Taler-etiketter, 99 sprog, alle eksportformater inkluderet.
Start gratis