Трансформирайте дълги аудио файлове.До 10 часа. Без ограничение.

Хвърлете дълго аудио файл — до 10 часа, 5 GB на Business. Разделяме в паралел, запазваме ID на говорещите последователно и връщаме една стенограма вместо номерирана папка.

Пусни своето аудио или видео

MP3 · WAV · M4A · MP4 · MOV · MKV · OGG · OPUS · FLAC · WEBM — up to 100 MB anonymously

Paste a link, we’ll fetch the audio

YouTube · TikTok · Vimeo · Twitter · SoundCloud · Spotify · 50+ more

Записвай директно от браузъра

Регистрацията отнема 30 секунди — записът се отваря веднага след това, в таблото.

No card required~90s per 60-min fileSRT · VTT · DOCX · TXTФайловете се изтриват автоматично след 24 ч.

↓ Файл от 5 часа, средата на стенограмата

Часовете вътре. Един чист файл навън.

Повечето инструменти се прекрачват около 90-минутната отметка или разделят вашето дълго записване на номерирани части, които трябва да стегнете. Разделяме в 12-минутни преклапящи се прозорци, ги обработваме в паралел и събираме наново с глобален преход на говорещите.

Стратегическа сесия на съветаREC 3 говорещи · 5:14:22 · 3.1 GB
автоматично открит en-GB44.1 kHz стерео · 192 kbps
~90s
Стенограма · един файл92% точност · t=3:14:08
S1

Вече сме три часа вътре — да се кръстосаме отново на точката на веригата на доставки от сутрешната сесия.

S2

Точно, поворотът във производството във Виетнам. Мисля, че пропуснахме риска от време на доставка.

S1

Времето на доставка се промени от 14 на 31 дни след промяната на тарифата.

S3

И това е преди да вземем предвид затлачването на пристанище в Long Beach.

92% през целия 5-часов файлDOCX · SRT · TXT · JSON

↓ This is the dashboard

This is what loads when the job finishes.

Same layout as the real dashboard — Summary, full Transcript, Speakers tab, Exports. Key points and action items extracted automatically. Auto-tags on every job.

Try it on your own file — it's free

Три реални опции · честно сравнение

Otter Pro. DIY Whisper разделяне. Или ние.

Потребителските инструменти ограничават дължината на файла и тихо съкращават. Whisper API има ограничение от 25 MB на заявка, така че правите разделувача сами. Ние приемаме целия 10-часов файл и връщаме една стенограма.

Option 01

Otter Pro

Ограничава дълги файлове на 4 часа на запис. Етикетите на говорещите се отклоняват след 2-часовата отметка.

Максимална дължина на файла4 часа (Pro niveau)
Максимален размер на файла~1.5 GB загрузка
ID на говорещите от край до крайОтклонения след 2 часа
Резултат на дълги файловеЕдин док, съкращен на капацитета
Цена$16.99/потребител/месец
Възобновяема загрузкаНе
Best forКратки срещи под 2 часа. Полудоставя при записване на цял ден.
Option 02

Transcription.Solutions

10 часа на файл. Паралелно разделяне, глобален преход на говорещите, един DOCX навън.

Максимална дължина на файла10 ��аса (Pro & Business)
Максимален размер на файла2 GB Pro · 5 GB Business
ID на говорещите от край до крайГлобален преход на вграждане
Резултат на дълги файловеЕдин файл · DOCX/SRT/TXT
Цена · на минута$0.03 плоска цена независимо от дължина
Възобновяема загрузкаМногодинаммна, оцелява спада
Best forЦялодневни работилници, показни разпити, срещи на съвета, устни истории — всичко след 90-минутната стена.
Option 03

Whisper API + DIY разделяне

Най-евтино на минута. Правите разделувача, събирането на говорещите и логиката на повторното опитване.

Максимална дължина на файла25 MB на заявка (~25 мин)
Максимален размер на файла25 MB твърдо ограничение
ID на говорещите от к��ай до крайНикой — не диаризация
Резултат на дълги файловеНомерирани части, правите събирането
Цена · на минута$0.006 (OpenAI Whisper)
Инженерно времеЧасове до дни на конвейер
Best forИнженери, които искат сирови текст на глава и не се нуждаят от говорещи, резюмета или един резултат.

Цени и ограничения точни към май 2026. Ограничението на дължина на Otter Pro последния път е проверено на тяхната публична страница на цени.

Специфично за дълги файлове

Три начина, по които генеричните инструменти полудават след 90-минутната отметка.

Повечето конвейери са построени за едночасови срещи. Дългото аудио ги прекъсва по предвидими начини — ето какво правим различно.

Какво се случва

  1. 1Тихо времеме при 90 минути. Работата се върти час, след което се умира без полезна грешка. Остават ви нищо за повторно опитване.
  2. 2ID на говорещите отклоняват между главите. Говор��щ 1 в час 1 става Говорещ 4 в час 3, защото всяка глава се резултира в диаризация в изолация.
  3. 3Резултатът е номерирана папка. `transcript_part_01.txt` до `transcript_part_24.txt` с нулиране на временни маркери на всяка граница на главата. Правите събирането сами.

Какво да промените тук

  1. 1Възобновяема многодинаммна загрузка. Свързване пада в час 2 на загрузка? Възобновява се от последния завършена глава. Не повторна загрузка на 4 GB.
  2. 2Глобален преход на вграждане на говорещите. След диаризация на глава, групираме гласове във целия файл, така че Говорещ 3 е един и същ човек в минута 12 и минута 487.
  3. 3Един DOCX с маркери на час. Един файл, непрекъснати временни маркери, опционална пауза на глава всеки 60 минути. Не събиране.

Препоръчвани настройки на работа за дълги файлове

Хвърлете всичко над 90 минути и тези се включват автоматично. Преопределете на работа от формуляра.

Стратегия на разделяне
12 минутни прозорци · 10-секундно преклапяне
Диаризация
Глобален преход през всички главе
Модел на говорещи
Дълга форма · 2-20 говорещи
Загрузка
Възобновяема многодинаммна
Опашка
Приоритет (Business план)
Експорт
Един DOCX · маркери на час включена

Accuracy · real-world numbers

92% се задържа във файл от 5 часа. Качеството остава плоско час по час.

Трудната част с дълго аудио не е моделът — това е поддържането на точност плоска от минута 1 до минута 600. Отклонение на говорещите и грешки на граница на главата са това, което убива повечето конвейери. Числата по-долу се измерват в пълнодължинни файлове на клиенти, а не първите 10 минути.

95%
Студийна дълга форма, един говорещ

Разказване на аудиокнига, самостоятелен подкаст, продиктуван ръкопис. 6-10 часа чист глас без шум на стаята. Не е необходима диаризация.

92%
Конферентна маса, 2-6 говорещи

Маса на конференция, приличен микрофон, 3-5 часа. Глобалният преход на говорещите поддържа ID стабилни през целия файл.

88%
Цялодневна работилница, микрофони на лапела

7-9 часов ден на треньор с предаване на микрофон и въпроси от публиката. Имената имат нужда от 5-минутен преход на чипове на говорещите.

82%
Полева кръгла маса, 8+ говорещи

Дълга устна история, фокусна група или панел със застъпващи се гласове и заобикалящ шум. Полезно, но очаквайте почистване.

Обичайни въпроси

8 неща, които хората попитват относно транскрибирането на дълго аудио.

01Какво е действителното ограничение на дължина и размер на файла?+
10 часа на файл както на Pro, така и на Business. Pro ограничава размера на файла на 2 GB, Business на 5 GB. Ако имате нещо по-дълго от 10 часа, разделете го веднъж в естествена пауза — ще запазим ID на говорещите последователно, ако ги качите назад на спина на един и същ проект.
02Получавам един стенограм или папка с номерирани части?+
Един файл. Винаги. DOCX, SRT, TXT или JSON — по ваш избор. Временните маркери работят непрекъснато от 00:00:00 до края на записа, не най-ново при всяка граница на главата.
03Колко време отнема 6-часов файл да се върне?+
Примерно 18-25 минути на Pro опашката, 8-12 на Business приоритет. Обработваме 12-минутните главе в паралел, така че времето на стената се мащабира под-линейна, а не минута по минута.
04ID на говорещите остават последователна от край до край?+
Да. След диаризация на глава, глобален преход на вграждане групира гласове във целия файл. Говорещ 3 в минута 12 е един и същ Говорещ 3 в минута 487. Това е главното нещо, което DIY Whisper конвейери получават неправилно.
05Какво се случва, ако моята загрузка пада в час 3 на 4 GB файл?+
Възобновяема многодинаммна загрузка бра от последния завършена глава. Не повторна загрузка на първите 3 GB. Работи на колебаво хотелско Wi-Fi и клетъчно окосмяване — тествахме и двете.
06Защо Whisper API се задушава на дълги файлове?+
OpenAI Whisper крайната точка има 25 MB твърдо ограничение на заявка — примерно 25 минути компресиран аудио. Всичко по-дълго изисква вас да разделите, резултат в паралел, след това събрании на стенограми и услов на говорещите сами. Правим всичко това на сървър-страна.
07Цената на минута е ли един и един и същ на 10-часов файл, както на 10-минутен файл?+
Да. $0.03 на минута плоска, независимо от дължина. 10-часов файл разходи $18. Не надлъчаваме дълги файлове по начина, който Rev прави ($1.50/мин човек × 10 часа = $900).
08Мога ли да получа маркери на глава или временни маркери всеки час?+
Пробвайте 'маркери на час' на формуляра на работа и DOCX експортни с пауза на заглавие всеки 60 минути. SRT запазва непрекъснат таймкод. JSON има и двите — глава масив плюс временни маркери на дума-niveau.

Хвърлете вашия дълго файл. Вземете един стенограм назад.

30 безплатни минути всеки месец. Без карта. Файлове до 10 часа, етикети на говорещите, които остават последователна, експорт на един файл.

Старт безплатно