Whisper lokail / open source
Frí um tú hevur GPU og ein dagur. Engin talari-merking út av boxinum.
Sleppið MP3 fil á hvørjari bitrate frá 64 til 320 kbps. Fáið tíðarmerkta, talari-merka transkripsjon á 99 tungumálum — eingir sniðsbytir, engin ný koding, eingin bið.
MP3 · WAV · M4A · MP4 · MOV · MKV · OGG · OPUS · FLAC · WEBM — up to 100 MB anonymously
YouTube · TikTok · Vimeo · Twitter · SoundCloud · Spotify · 50+ more
↓ Síggj hvat kemur út
Við lesa MP3 frame headers beinleiðis — VBR, CBR, joint-stereo, hvørji kodarar (LAME, Fraunhofer, FFmpeg). Var filan sannarlega stereo við talara á aðskildum kanálum, brúka við tað til at skilja røddirnar. Mono blanda fellur aftur til akustisk talari-merking.
Ja, nær hugðu tú fyrstu ferð at arkivið var ófullt?
Væntandi umleið 2019, nær við byrjuðu at digitalisera reel-til-reel.
Og teir týndu bandom — váru teir katalogerat nokkustaðni ó?
Tað er paper index frá '78, men helmingur av tí er vatnaskada.
↓ This is the dashboard
Same layout as the real dashboard — Summary, full Transcript, Speakers tab, Exports. Key points and action items extracted automatically. Auto-tags on every job.
Sample preview from a founder interview about post-call workflow. Real transcripts look exactly like this — same tabs, same summary block, same key-points / action-items split, same auto-tag chips.
Trý sannarlegar möguleikar · hónafallig samboring
Tú kanst keyra Whisper á tínum egna tölvu frítt um tú ert teknisk dönskligur. Otter og Sonix taka MP3 luttrekk inni subscription dashboards. Við taka filnar, skila transkriptum, og tvingja teg ikki inn í UI.
Frí um tú hevur GPU og ein dagur. Engin talari-merking út av boxinum.
Sleppið MP3. Fáið talari-merka tekstur aftur við rauntíð × 0.025.
Snøgg interface, mánaðarlig minuttir lokun, English-tutað. Fil uploadingur er side feature.
Verðlagning og feature availability nákvær sum av May 2026. Whisper performance vøksar við model størrleik og hardware.
Specifikt til MP3
MP3 er snið, ikki ein recording stíll — sum merkir at mistøkuir koma frá encoder, ikki frá talanum.
Standard stillingar sum passa ~80% av MP3 fílum. Breyta per-job frá forminum.
Accuracy · real-world numbers
MP3 nákvemni er bund av hvat encoder haldt, ikki av okkum. Perseptuanst þjøppun yvir ~96 kbps varðveitir tal intelligibility væl; niðan 64 kbps, sibilantir og consonantir byrja at solevna. Tal niðanfyri eru frá sannarlyk customer MP3um í framleiðslu.
Near-lossless fyri tal. Podcast masters, diktering app útflutning, professional interview rigs. Talari-merking er hrein um talara eru á aðskildum kanálum.
Mest common bitrate fyri spoken-word MP3s. Zoom útflutning, Riverside download, rødd recordings by default. Þjøppun artifacts eru óhøyrar fyri recognizer.
Rødd memo by default á flestum phones. Akustisk talari-merking handleir 2-4 talara. Numer og privatenavnir tørva eina sinni ein yvirlestur.
Gamla answering-machine rips, lecture archives, narrow-band heimili. High-frequency consonantir (f/s/sh) blakra. Ótil lesanlig — áætla ein próflestur.
Common questions
30 fríar minuttir hvørja mánað. Engin kort neyðug. Talari merking, 99 tungumál, hvørji útflutnings format inni.
Start frítt