Whisper локальний / відкритий код
Безплатно, якщо у вас є GPU та вільний час. Без розпізнавання промовців з коробки.
Завантажте MP3 файл будь-якої бітрейти від 64 до 320 kbps. Отримайте розмічену часовими мітками, з позначеннями промовців стенограму в 99 мовах — без конвертування формату, без перекодування, без очікування в черзі.
MP3 · WAV · M4A · MP4 · MOV · MKV · OGG · OPUS · FLAC · WEBM — up to 100 MB anonymously
YouTube · TikTok · Vimeo · Twitter · SoundCloud · Spotify · 50+ more
↓ Дивіться, що вийде
Ми читаємо заголовки кадрів MP3 безпосередньо — VBR, CBR, joint-stereo, будь-який кодер (LAME, Fraunhofer, FFmpeg). Якщо файл — справжнє стерео з промовцями на окремих каналах, ми використовуємо це для поділу голосів. Мішування до моно переходить на акустичне розпізнавання промовців.
Коли ти вперше зрозумів, що архів неповний?
Мабуть, близько 2019 року, коли ми почали оцифровувати котушки.
А відсутні касети — вони взагалі були каталогізовані?
Є паперовий індекс з 78 року, але половина його пошкоджена водою.
↓ This is the dashboard
Same layout as the real dashboard — Summary, full Transcript, Speakers tab, Exports. Key points and action items extracted automatically. Auto-tags on every job.
Sample preview from a founder interview about post-call workflow. Real transcripts look exactly like this — same tabs, same summary block, same key-points / action-items split, same auto-tag chips.
Три реальні варіанти · чесне порівняння
Ви можете запустити Whisper на своному ноутбуці безплатно, якщо вмієте програмувати. Otter та Sonix приймають завантаження MP3 у панелях передплати. Ми беремо файл, повертаємо стенограму та не змушуємо вас жити у інтерфейсі.
Безплатно, якщо у вас є GPU та вільний час. Без розпізнавання промовців з коробки.
Завантажте MP3. Отримайте текст з позначеннями промовців майже в реальному часі × 0,025.
Полірована панель, щомісячна кількість хвилин, налаштована для англійської. Завантаження файлу виглядає як побічна функція.
Ціни та доступність функцій точні на травень 2026 р. Продуктивність Whisper залежить від розміру моделі та обладнання.
Специфічно для MP3
MP3 — це формат, не стиль запису — що означає режими відмови виникають із кодера, не з мови.
Параметри за замовчуванням, які підходять ~80% файлів MP3. Перевизначити за завданням з форми.
Accuracy · real-world numbers
Точність MP3 обмежена тим, що кодер зберіг, не нами. Розпізнавальна компресія вище ~96 kbps дуже добре зберігає зрозумілість мови; нижче 64 kbps, сибілянти та приголосні починають розчинятися. Цифри нижче — від справжніх MP3 клієнтів у виробництві.
Майже без втрат для мови. Майстер-версії подкастів, експорти з додатку диктування, професіональна апаратура для інтерв'ю. Розпізнавання промовців чисте, якщо промовці на окремих каналах.
Найпоширеніша бітрейта для розмовних MP3. Експорти Zoom, завантаження Riverside, голосові записувачі за замовчуванням. Артефакти компресії непомітні розпізнавачу.
За замовчуванням голосові записки на більшості телефонів. Акустичне розпізнавання промовців обробляє 2-4 промовців. Числа та власні імена інколи потребують перевірки.
Старі дампи автовідповідача, архіви лекцій, вузькосмугові джерела. Високочастотні приголосні (f/s/sh) розмиваються. Все ще читаєма — планіруйте перевірку.
Часті запитання
30 безплатних хвилин щомісяця. Без карти. Позначення промовців, 99 мов, всі формати експорту включені.
Почати безплатно