Whisper paikallinen / avoimen lähdekoodin
Ilmainen, jos sinulla on GPU ja iltapäivä vapaana. Ei puhujadiarisointia valmiiksi.
Pudota MP3-tiedosto mihin tahansa bittinopeudella 64–320 kbps. Saa aikaleimalla ja puhujalla merkitty litterointi 99 kielellä — ei muodonmuuntoa, ei uudelleenkoodausta, ei jonoon odottamista.
MP3 · WAV · M4A · MP4 · MOV · MKV · OGG · OPUS · FLAC · WEBM — up to 100 MB anonymously
YouTube · TikTok · Vimeo · Twitter · SoundCloud · Spotify · 50+ more
↓ Katso mitä tulee ulos
Luemme MP3-kehysotsikoita suoraan — VBR, CBR, joint-stereo, mikä tahansa kooderi (LAME, Fraunhofer, FFmpeg). Jos tiedosto on todellinen stereo ja puhujat ovat erillisillä kanavilla, käytämme sitä ääniä jakamaan. Mono-miksaus palaa akustiseen diarisointiin.
Joten milloin huomasit ensimmäisen kerran, että arkisto oli epätäydellinen?
Todennäköisesti noin 2019, kun aloimme digitoida rulla-nauhat.
Ja puuttuvat nauhat — oliko ne katalogoi missään?
On olemassa paperinen indeksi vuodelta '78, mutta puoli siitä on vesivaurioitunut.
↓ This is the dashboard
Same layout as the real dashboard — Summary, full Transcript, Speakers tab, Exports. Key points and action items extracted automatically. Auto-tags on every job.
Sample preview from a founder interview about post-call workflow. Real transcripts look exactly like this — same tabs, same summary block, same key-points / action-items split, same auto-tag chips.
Kolme todellista vaihtoehtoa · rehellinen vertailu
Voit käyttää Whisperia omalla kannettavallasi ilmaiseksi, jos osaat tekniikkaa. Otter ja Sonix hyväksyvät MP3-lataukset tilauskojeissa. Me otamme tiedoston, palautamme litteroinnin, ja emme pakota sinua elämään käyttöliittymän sisällä.
Ilmainen, jos sinulla on GPU ja iltapäivä vapaana. Ei puhujadiarisointia valmiiksi.
Pudota MP3. Saa puhujalla merkitty teksti takaisin suunnilleen reaaliajassa × 0,025.
Kiillotettu kojeisto, kuukausittainen minuuttien raja, englannin kielen hienosäätö. Tiedostolataus tuntuukin sivuominaisuudelta.
Hinnoittelu ja ominaisuuksien saatavuus tarkkana toukokuussa 2026. Whisper-suorituskyky vaihtelee mallin koon ja laitteiston mukaan.
Spesifistä MP3:lle
MP3 on muoto, ei tallennustyyli — mikä tarkoittaa, että ongelmatilanteet tulevat kooderista, ei puheesta.
Oletusarvot, jotka sopivat ~80%:iin MP3-tiedostoista. Ohita per-työ lomakkeelta.
Accuracy · real-world numbers
MP3-tarkkuus on rajoitettu sillä, mitä kooderi säilyi, ei meistä. Perceptuaalinen pakkaus yli ~96 kbps säilyttää puheenjäljityksen erittäin hyvin; alle 64 kbps:n, sibilantit ja konsonantit alkavat haihtua. Alla olevat luvut ovat todellisista asiakkaiden MP3:stä tuotannossa.
Lähes häviötön puheelle. Podcast-perustuotteet, sanelu-sovelluksen vienti, ammattimainen haastattelu. Diarisisointi puhdas, jos puhujat erillisillä kanavilla.
Yleisin bittinopeus puhuttujen MP3:ien osalta. Zoom-vienti, Riverside-lataukset, ääniuudelleen kirjaimet oletus. Pakkauskohina tuntematon tunnustajalle.
Äänimuistiosta oletuslinja useimmissa puhelimissa. Akustinen diarisisointi käsittelee 2-4 puhujaa. Numerot ja omat nimet tarvitsevat joskus silmäilya.
Vanha vastauskoneen riisumiset, luento-arkistot, kapeakaista-lähteet. Korkean taajuuden konsonantit (f/s/sh) sumentuvat. Silti luettava — suunnittele oikoluku.
Usein kysytyt kysymykset
30 ilmaista minuuttia joka kuukausi. Ei korttia vaaditaan. Puhuja-merkinnöt, 99 kielillä, jokainen vienin muoto mukana.
Aloita ilmaiseksi