Whisper lokal / OpenSource
Gratis, wann Dir eng GPU an engem Owend hutt. Keng Spriecher-Diarisierung out of the box.
Setzt eng MP3-Datei a mat engem Bitrate vun 64 bis 320 kbps. Kréie eng Transkriptioun mat Zäitstempel an Spriecher-Markéierungen a 99 Sproochen — keng Format-Konversioun, keng Noriichten, kee Waarden op enger Queue.
MP3 · WAV · M4A · MP4 · MOV · MKV · OGG · OPUS · FLAC · WEBM — up to 100 MB anonymously
YouTube · TikTok · Vimeo · Twitter · SoundCloud · Spotify · 50+ more
↓ Schau, wat erauskommt
Mir liesen d'MP3 Frame Headers direkt — VBR, CBR, Joint-Stereo, all Encoder (LAME, Fraunhofer, FFmpeg). Wann d'Datei true Stereo ass mat Spriecher op separaten Kanäl, benotze mir dat fir Stëmmen ze splëtten. Mono Mix-Down fällt op akoustech Diarisierung zréck.
Also wéini hu Dir fir d'éischt réaliséiert, datt d'Arkiv onvollständeg war?
Wahrscheinlech ronderëm 2019, wéini mir d'Reel-to-Reels digitaliséiert hunn.
An d'vermëschte Bänner — goufen se iergendwou katalogéiert?
Et ginn en Pabeier-Index vun '78, mä hallef dovun ass wasser-beschiedegt.
↓ This is the dashboard
Same layout as the real dashboard — Summary, full Transcript, Speakers tab, Exports. Key points and action items extracted automatically. Auto-tags on every job.
Sample preview from a founder interview about post-call workflow. Real transcripts look exactly like this — same tabs, same summary block, same key-points / action-items split, same auto-tag chips.
Dräi richteg Optiounen · Häerlich Verglach
Dir kënnt Whisper op Iech eegen Laptop gratis lafen, wann Dir technesch sinn. Otter an Sonix akzeptéieren MP3-Uploads an Abonnements-Dashboards. Mir huelen d'Datei, ginn d'Transkriptioun zréck, an zwéngen Iech net, an enger UI ze liewen.
Gratis, wann Dir eng GPU an engem Owend hutt. Keng Spriecher-Diarisierung out of the box.
Setzt d'MP3 a. Kritt Spriecher-markéiert Text zréck a ongeféier Echt-Zäit × 0.025.
Poliert Dashboard, monatlech Minutten-Grenz, Englesch-optimaliséiert. Datei-Upload fillt sech un wéi eng Sëit-Feature.
Präiswäerter an Feature-Verfügbarkeet akkurat wéi vun Mai 2026. Whisper-Performen variéiert duerch Modell-Gréisst an Hardware.
Spézifesch zu MP3
MP3 ass en Format, net en Opnamen-Stil — dat heescht d'Feeler-Modi sti vum Encoder, net vun der Stëmmen.
Defaults, déi op ~80% vun MP3-Dateien passen. Iwwerschreiwe pro-Job vum Formulair.
Accuracy · real-world numbers
MP3 Genauegkeet ass begrenzt duerch wat den Encoder behalen, net duerch mir. Wahrnehmungskompressioun iwwer ~96 kbps erhält Stëmmen-Intellegibilitéit ganz gutt; ënner 64 kbps, Sibilanten an Konsonanteri starten ze léisen. Zuelen drënner sinn vun richtegen Clienten MP3s an der Produktioun.
Bal verlustfräi fir Stëmmen. Podcast-Meister, Diktatiouns-App-Exporte, beruffleschen Interview-Rigs. Diarisierung reng, wann Spriecher op separaten Kanäl.
Déi meescht Iecht Bitrate fir gespréchtem-Wuert MP3s. Zoom Exporte, Riverside Downloads, Stëmmen-Rekorder Standard. Komprelessioun-Artefakte onhéirbar fir Erkennungstool.
Stëmmen-Notiz Defaults op de meeschten Telefonen. Akoustech Diarisierung handelt 2-4 Spriecher. Nummeren an Eigennimm brauchen heiw an deier eng Bléck.
Aal Antwort-Appareil-Ripen, Léiergang-Arkiver, Schmuell-Bande-Quellen. Heechfréquenz-Konsonanteri (f/s/sh) verunscharfen. Noch ëmmer lesbar — plangt eng Korrektur.
Gemeinsam Froen
30 gratis Minutten all Moone. Keng Kaart néideg. Spriecher-Markéierungen, 99 Sproochen, all Export-Format abegraff.
Fräi Start