Whisper лакальны / адкрыты код
Бясплатна, калі ў вас ёсць GPU і запасны час. Дыяризацыя дыктараў не ўключана з кробкі.
Перацягніце файл MP3 пры любой бітрэйце ад 64 да 320 kbps. Атрымайце пазначаны часам, са спліцімі дыктараў транскрыпт на 99 мовах — без пераўтварэння фармату, без пераквадравання, без чакання ў чарзе.
MP3 · WAV · M4A · MP4 · MOV · MKV · OGG · OPUS · FLAC · WEBM — up to 100 MB anonymously
YouTube · TikTok · Vimeo · Twitter · SoundCloud · Spotify · 50+ more
↓ Гляджыце, што выйдзе
Мы чытаем загалоўкі кадраў MP3 прамо — VBR, CBR, joint-stereo, любы кодэк (LAME, Fraunhofer, FFmpeg). Калі файл сапраўды стэрэа з дыктарамі на асобных каналах, мы выкарыстоўваем гэта, каб разыдзяліць голасы. Мага-план падае назад на акустычную дыяризацыю.
Так калі вы адчулі, што архіў неполны?
Верагодна, каля 2019 года, калі мы пачалі дыджыталізаваць касеты.
А адсутнічаючыя касеты — яны ў якой-небудзь каталогу?
Ёсць паперовы індэкс з '78, але палова яго пашкоджана водай.
↓ This is the dashboard
Same layout as the real dashboard — Summary, full Transcript, Speakers tab, Exports. Key points and action items extracted automatically. Auto-tags on every job.
Sample preview from a founder interview about post-call workflow. Real transcripts look exactly like this — same tabs, same summary block, same key-points / action-items split, same auto-tag chips.
Тры сапраўдныя варыянты · чэсны параўнанне
Вы можаце запусціць Whisper на вашым лаптопе бясплатна, калі ў вас ёсць тэхнічныя навыкі. Otter і Sonix прымаюць загрузкі MP3 у дашбордах падпіскі. Мы прымаем файл, вяртаем транскрыпт — і не забяспечваем вам жыць у інтэрфейсе.
Бясплатна, калі ў вас ёсць GPU і запасны час. Дыяризацыя дыктараў не ўключана з кробкі.
Закіньце MP3. Атрымайце тэкст з пазнакамі дыктараў практычна ў рэальным часе × 0,025.
Палаваны дашборд, ліміт хвілін у месяц, англійскі-ўлованны. Загрузка файлаў выглядае як побакавая функцыя.
Цаны і наяўнасць функцыяў дакладны на май 2026. Прадукцыйнасць Whisper зависит ад памеру мадэлі і апаратнага абеспячэння.
Спецыфічна для MP3
MP3 — гэта фармат, не сцвіль запісу — адзін інструмэнты праблемы ідуць ад кодэка, не ад мовы.
Стандарты, якія адпавядаюць ~80% файлаў MP3. Перавызначае за заданне ў формі.
Accuracy · real-world numbers
Дакладнасць MP3 абмежавана тым, што захаваў кодэк, а не мною. Перцэптыўная кампрэсія вышэй ~96 kbps добра захоўває ўлаўлівасць мовы; ніжэй 64 kbps свістпяцы звукі і сумны пачынаюць расплаўляцца. Нумары ніжэй — з сапраўдных файлаў MP3 кліентаў у прадукцыі.
Практычна без страт для мовы. Асноўныя подкасты, экспорты дыктофона, прафесійныя іміэнцы. Дыяризацыя чыста, калі дыктары на асобных каналах.
Найбольш частая бітрэйт для мовяшчага тэксту MP3. Экспорты Zoom, загрузкі Riverside, стандартныя голасавыя рэкордэры. Артэфакты кампрэсіі нечутныя для распазнавальніка.
Стандартныя выкрыўкі голасавых нотак на большасці тэлефонаў. Акустычная дыяризацыя справляецца з 2-4 дыктарамі. Наміры і ўласныя імёны часам трэба паглядзець.
Старыя рыпы з адказніка, архіўныя лекцыі, вузкізіс-канальныя крыніцы. Высокачастотныя сумны (f/s/sh) размыты. Яшчё чытаецца — плануй��е карэкцыю.
Частыя пытанні
30 бясплатных хвілін кожны месяц. Карта не потрібна. Пазнакі дыктара, 99 моў, ўсе фарматы экспорту ўключаны.
Пачаць бясплатна