Whisper локален / open source
Бесплатно ако имате GPU и време. Без дијаризација на говорници по дефолт.
Пуштете MP3 датотека при која било брзина од 64 до 320 kbps. Добијте временски означена, транскрипција со етикети за говорници на 99 јазици — без конверзија на формат, без повторно кодирање, без чекање во ред.
MP3 · WAV · M4A · MP4 · MOV · MKV · OGG · OPUS · FLAC · WEBM — up to 100 MB anonymously
YouTube · TikTok · Vimeo · Twitter · SoundCloud · Spotify · 50+ more
↓ Видете што излегува
Ги читаме MP3 frame headers директно — VBR, CBR, joint-stereo, по какво било кодирање (LAME, Fraunhofer, FFmpeg). Ако датотеката е вистинско stereo со говорници на одделни канали, го користиме тоа за да раздвоиме гласови. Mono мешање се враќа на акустичната дијаризација.
Кога за прв пат сфативте дека архивот е непотполн?
Веројатно околу 2019, кога почнавме да дигитализираме reel-to-reels.
А недостасување касетите — дали се каталогизирани некаде воопште?
Има хартиен индекс од '78, но половина од него је оштетена од вода.
↓ This is the dashboard
Same layout as the real dashboard — Summary, full Transcript, Speakers tab, Exports. Key points and action items extracted automatically. Auto-tags on every job.
Sample preview from a founder interview about post-call workflow. Real transcripts look exactly like this — same tabs, same summary block, same key-points / action-items split, same auto-tag chips.
Три вистински опции · честно споредување
Можете да го извршите Whisper на вашиот лаптоп бесплатно ако сте технички способни. Otter и Sonix прифаќаат MP3 поставени во рамките на subscription dashboard-и. Ја земаме датотеката, ја враќаме транскрипцијата, и не ви наметнуваме да живеете внатре UI.
Бесплатно ако имате GPU и време. Без дијаризација на говорници по дефолт.
Пуштете го MP3. Добијте текст со етикети за говорници назад за релативно вистинско време × 0.025.
Полиран dashboard, месечна граница на минути, англиски-наредување. Поставување датотека изгледа како страничен функција.
Цена и достапност на ф��нкции точни кон май 2026. Whisper перформанса варира според величина на модел и хардвер.
Специфично за MP3
MP3 е формат, не стил на снимање — што значи дека режимот на неуспех доаѓа од кодирачот, не од говорот.
Дефолти кои одговараат ~80% од MP3 датотеки. Override по-работа од формата.
Accuracy · real-world numbers
MP3 точност е ограничена од што кодирачот ја задржа, не од нас. Перцептуална компресија над ~96 kbps одлично ја зачувува говорната разбирливост; надолу од 64 kbps, sibilants и consonants почнуваат да се расипуваат. Броевите подолу се од вистински MP3 на клиенти во производство.
Скоро-без-загуба за говор. Podcast мастери, диктатор приложувања, професионален интервју риг. Дијаризација чиста ако говорници на одделни канали.
Најчеста брзина за говорни MP3. Zoom експорти, Riverside преземања, voice recorder дефичнии. Компресија артефакти читав на препознавач.
Voice memo дефолти на повеќе телефони. Акустична дијаризација справува 2-4 говорници. Броеви и имена понекогаш требаат да видите.
Стари машина за одговори рипови, лекция архиви, narrow-band извори. Високо-фреквентност consonants (f/s/sh) замаглени. Сé уште разбирливо — планирајте проверка.
Чести прашања
30 слободни минути секој месец. Нема картичка потребна. Етикети за говорници, 99 јазици, секој експорт формат вклучен.
Почни слободно