Whisper local / open source
Zdarma, máte-li GPU a odpoledne. Bez diarizace mluvčích standardně.
Vhoďte MP3 soubor v jakékoliv přenosové rychlosti od 64 do 320 kbps. Získejte časovaný, s identifikací mluvčích označený přepis v 99 jazycích — bez konverze formátu, bez překódování, bez čekání ve frontě.
MP3 · WAV · M4A · MP4 · MOV · MKV · OGG · OPUS · FLAC · WEBM — up to 100 MB anonymously
YouTube · TikTok · Vimeo · Twitter · SoundCloud · Spotify · 50+ more
↓ Podívejte se, co vyjde
Čteme MP3 hlavičky snímků přímo — VBR, CBR, joint-stereo, jakýkoliv kodér (LAME, Fraunhofer, FFmpeg). Pokud je soubor skutečný stereo s mluvčími na samostatných kanálech, použijeme to k rozdělení hlasů. Mono mix-down se vrací k akustické diarizaci.
Takže kdy jste si poprvé uvědomili, že archiv je neúplný?
Pravděpodobně kolem roku 2019, když jsme začali digitalizovat cívky.
A chybějící kazety — byly někde katalogizovány?
Máme papírový index z roku 78, ale poloviny je poškozena vodou.
↓ This is the dashboard
Same layout as the real dashboard — Summary, full Transcript, Speakers tab, Exports. Key points and action items extracted automatically. Auto-tags on every job.
Sample preview from a founder interview about post-call workflow. Real transcripts look exactly like this — same tabs, same summary block, same key-points / action-items split, same auto-tag chips.
Tři reálné možnosti · upřímné srovnění
Máte-li technické vědomosti, můžete spustit Whisper zdarma na svém vlastním laptopu. Otter a Sonix přijímají nahrávání MP3 v rámci dashboardů předplatného. My vezměme soubor, vrátíme přepis a nenutíme vás žít uvnitř uživatelského rozhraní.
Zdarma, máte-li GPU a odpoledne. Bez diarizace mluvčích standardně.
Vhoďte MP3. Dostanete text s identifikací mluvčích zpět přibližně v reálném čase × 0,025.
Vyleštěný dashboard, měsíční limit minut, ladění pro angličtinu. Nahrávání souborů se cítí jako vedlejší funkce.
Ceny a dostupnost funkcí jsou přesné od května 2026. Výkon Whisperu se liší podle velikosti modelu a hardwaru.
Specifické pro MP3
MP3 je formát, ne styl nahrávání — což znamená, že chybové módy pocházejí z kodéru, ne z řeči.
Výchozí nastavení, která vyhovují ~80% MP3 souborů. Přepište za úlohu pomocí formuláře.
Accuracy · real-world numbers
Přesnost MP3 je omezená tím, co kodér zachoval, ne námi. Perceptuální komprese nad ~96 kbps velmi dobře zachovává srozumitelnost řeči; pod 64 kbps začínají sibilanty a souhlásky rozpouštět. Čísla níže pocházejí ze skutečných MP3 zákazníků v produkci.
Téměř bezeztrátový pro řeč. Podcastové mastery, exporty diktovací aplikace, profesionální nahrávací soupravy. Diarizace je čistá, jsou-li mluvčí na samostatných kanálech.
Nejčastější přenosová rychlost pro mluvené MP3. Exporty Zoom, Riverside stahování, výchozí hlasové rekordéry. Kompresní artefakty jsou nepoznatelné pro rozpoznávač.
Výchozí nastavení hlasové poznámky na většině telefonů. Akustická diarizace zvládá 2–4 mluvčí. Čísla a vlastní jména občas vyžadují pohled.
Staré záznamy z hlasové pošty, archiv přednášek, zdroje v úzkopásmovém spektru. Vysokofrekvenční souhlásky (f/s/sh) jsou rozmazané. Stále čitelné — plánujte si korekci.
Částé otázky
30 minut zdarma každý měsíc. Bez karty. Identifikace mluvčích, 99 jazyků, každý formát exportu je zahrnut.
Začít zdarma