Транскрыбуйце видэа MP4 у тэкст.Аўдыё вышуква аўтаматычна.

Кіньце файл MP4 як ёсць — мы вышуковаем дарэчаны асобна на боку сервера, вяртаем адзначаны времёнам тэкст і дасылаем SRT, які адразу вяртаецца ў YouTube, Vimeo або ваш NLE.

Перацягніце аўдыя ці відэа

MP3 · WAV · M4A · MP4 · MOV · MKV · OGG · OPUS · FLAC · WEBM — up to 100 MB anonymously

Paste a link, we’ll fetch the audio

YouTube · TikTok · Vimeo · Twitter · SoundCloud · Spotify · 50+ more

Запісвайце проста з браўзера

Рэгістрацыя за 30 секунд — запіс адкрываецца адразу пасля, у панэлі.

No card required~90s per 60-min fileSRT · VTT · DOCX · TXTФайлы аўтавыдаляюцца праз 24 г

↓ Паглядзіце, што выходзіць

MP4 ўвайде. Тэкст + SRT вайде.

MP4 — гэта контэйнер — мы читаем поток аўдыё прама, никогда не перекодируем видео. Временные метки остаются точными на вашей исходной временной шкале, поэтому SRT выравнивается при первом импорте.

training-module-04.mp4REC 1080p · 22:14 · 412 MB
auto-detected en-USAAC 48 kHz stereo · 192 kbps
~90s
Тэкст · трансляцыя95% дакладнасці
S1

Добра, у гэтым модулі мы разглядаем працэс вяртання пеняга ад канца да канца.

S2

Хуткае пытанне да таго, як мы пачнём — гэта датычыцца і частковых вяртанняў?

S1

Добра заўважыў. Частковыя вяртанні выкарыстоўваюць адзін і той жа экран, але іншы код прычыны.

S2

Зрозумелы. І парог затвярджэння ўсё яшчэ дзвесце долараў?

95% на чыстым дыялогуSRT · VTT · DOCX · TXT · JSON

↓ This is the dashboard

This is what loads when the job finishes.

Same layout as the real dashboard — Summary, full Transcript, Speakers tab, Exports. Key points and action items extracted automatically. Auto-tags on every job.

Try it on your own file — it's free

Тры рэальныя варыянты · адвярчаны параўнанне

DIY з ffmpeg. Рэдактар видэа. Або мы.

Вы можаце вышукаць аўдыё сярма і запусціць Whisper. Вы можаце перацягнуць MP4 у Descript або VEED і жыць у іх рэдактары. Або вы можаце кінуць файл сюды і атрымаць тэкст + SRT назад, без блакавання редактара.

Option 01

ffmpeg + Whisper

Бясплатна, лакальна, капотлівы. Вы ўтрымаеце конвейер і кожную хібу ў ім.

ПатрэбнаCLI + 10 GB модэль + GPU
Дыферэнцыяцыя дыктарoўАсобны інструмент (pyannote)
Вывад SRTТак, ручны флаг
Час на адзінагадзінны MP420–90 мін на CPU
Мультітрэковы аўдыёВы выбіраеце поток
Кошт$0 + ваш апаратны
Best forІнжынеры, якія ужо запускаюць Whisper лакальна і не возьму ў розум прышпіхаць дыферэнцыяцыю зверху.
Option 02

Transcription.Solutions

Кіньце MP4. Вышука аўдыё, дыферэнцыяцыя, SRT, рэзюмэ — адзін праход.

ПатрэбнаБраўзер, вот і ўсё
Дыферэнцыяцыя дыктарoўУбудаваны, кожная праца
Вывад SRTВыравніцы па кадрах да источника
Час на адзінагадзінны MP4~4 хв, трансляцыя
Мультітрэковы аўдыёМы пералічваем усе потокі
Кошт · за хвіліну$0.03
Best forКожны з MP4, які хочэ атрымаць тэкст і SRT без вучэння відэорэдактара або CLI.
Option 03

Descript / VEED

Загрузіце MP4 у рэдактар. Тэкст з'яўляецца часткай інтэрфейса шкалы часу.

ПатрэбнаАкаўнт + крыва навучання рэдактара
Дыферэнцыяцыя дыктарoўТак, EN-настройка
Вывад SRTЭкспорт-гейтэд плёнам
Ліміт загрузкі5 GB (Descript бясплатна)
Мультітрэковы аўдыёТолькі першы поток
Кошт$12–24/карыстальнік/мес
Best forРэдактары, я��ія хочуць різаць видэа і тэкст у адным інструменце.

Цаны і ліміты функцыяў набліжаныя па стану на 2026. Імёны ўзроўняў Descript і VEED часта змяняюцца — праверце іх сайт для актуальных ліміцаў.

Спецыфіка MP4

Тры рэчы, якія выклікаюць праблемы з звычайнымі інструментамі транскрыпцыі.

MP4 — гэта контэйнер, не кодэк — і большасць інструментаў транскрыпцыі адносяцца да яго як адзін вялікі blob аўдыё. Менавіта адкуль прыходзяць абірае.

Што адбываецца

  1. 1Мультітрэковы MP4 з boom + lav. Звычайныя інструменты ўзяць першы трэк і ігнаруюць астатнёе, таму вы страчаеце чыста мік. Звычайны на FCP і Premiere экспорт.
  2. 2Фонаграма музыкі ў блогах і аб'явох вспыхіваюць фантомныя словы. Распазнавальнік спрабуе транскрыбаваць вакалы на музычным ложу.
  3. 3Часавыя адзнакі SRT дрэйфуюць, калі інструмент пера-кадуе видэа на ўжо ў. На 40 хвіліне субцібліі адстаюць на секунду.

Што пераверну тут

  1. 1Загрузіце — мы зондуем кожны поток аўдыё і даём вам выбраць, які адзін транскрыбуе. Па змаўчанню найвышейшы-бітрэйт трэк.
  2. 2Уключыце Блакаванне музыкі на форме задачы. Мы гейціем распазнавальнік на мову VAD, таму інструментальныя раздзелы застаюцца пустымі.
  3. 3Мы никогда не перекодируем видео. Аўдыё вышуква пры асяродніцы частаце дыскрэцыі, часавыя адзнакі спасылаюцца на спіс чистакірвання контэйнера — SRT выравніцы па кадрах.

Рекамендуемыя параметры задачы для MP4

Кіньце MP4 і яны ўключаюцца па змаўчанню. Замяніце за задачу з формы.

Вышука аўдыё
Асяродніцы частата дыскрэцыі, без пера-кадавання
Выбар трэка
Найвышейшы-бітрэйт поток
Дыферэнцыяцыя
Акустычны · 1-6 дыктарoў
Блакаванне музыкі
Уключа для блога/рэклама прэсетаў
Фармат SRT
≤42 сімвал/рядок, 2 рядкі макс
Экспорт
SRT · VTT · DOCX · адзначаны времёнам TXT

Accuracy · real-world numbers

95% на чыстым знімку. Часнікавыя лічбы, калі аўдыё дае адсор.

Дакладнасць MP4 устаноўлена мікрофонам, не кодэком. Лавейны мік на спакойным нгаўе біць встроінае аўдыё 4K камеры кожны разу. Лічбы ніжэй прыходзяць з рэальных MP4 кліентаў, адсартыраваных па тыму, што здзімалася аўдыё.

96%+
Студыйны знімак, лавейны або дробавы мік

Лавейны або бум у рэкордэр, 48 кХц AAC у 192+ кбіт/с, апрацаваная кімната. Падобнасці выпадку. Мітка дыктарoў выстаўляе яе на двухчалавечны знімак.

93%
DSLR з шотганам на камеры

Мік на вяршыні камеры 2-4 футы ад дыктара. Некаторы тон амбієнта, але мова зразуміла. Большасць YouTube творцоў адпавядаюцца тут.

89%
Запіс экрана з USB мікрафонам

OBS, Loom, Camtasia экспорт. Мік блізкі, але кімната не апрацаваная, часто з утечкай сістэмнага аўдыё. Досыць добра для уроку транскрыптаў.

84%
Телефонны блог, унутраны мік

Убудаваны телефонны мік, вецер або апрацоўка шума, адлегласць змяняецца кадр за кадрам. Словы выкарыстоўваюцца, чакайце 1-2 фіксацыі за хвіліну на ўласнымі атрыбутамі.

Частыя пытанні

8 пытанняў, якія людзі пытаюцца пра транскрыпцыю MP4.

01Вы пера-кадуеце мой видэа?+
Не. Мы толькі читаем поток аўдыё з контэйнера MP4. Поток видэа никогда не адкрываецца, никогда не перекодируется, і ни��огда не захоўваецца пасля завяршэння задачы — вы ўтрымаеце свой зыходны файл без змен.
02Якія кодэкі ўнутры MP4 падтрымваюцца?+
Стандартны H.264 + AAC — простая справа. Мы таксама апрацоўваем HEVC/H.265, ProRes-у-MP4 і аўдыё ў MP3, Opus, ALAC або PCM. Калі ffmpeg можа зондаваць, мы можам транскрыбаваць.
03Якая ліміт памеру файла?+
10 GB за загрузку ў браўзэры, 50 GB праз API з аднаўляльнымі кускамі. Тыповы адзінагадзінны 1080p MP4 — 1-3 GB, таму большасць файлаў умяшчаюцца у браўзэр шляху без роздумаў.
04Ці SRT выравняцца з мойм зыходным видэа?+
Так — часавыя адзнакі спасылаюцца на спіс чистакірвання MP4 і асяродніцы частату дыскрэцыі. Мы не пера-кадуем, таму няма дрэйфу. Кіньце SRT рядам з MP4 у любы плэер або NLE і субцібліі сінхронізуюцца пры першай загрузцы.
05Ці я могу спаліць субцібліі у видэа?+
Не на нашай боку — мы вывадзім SRT і пакідаем спільванне вашыму рэдактару. ffmpeg адзін лайнер, HandBrake, Premiere, DaVinci, Kapwing усе прымаюць SRT, якую мы вырабляем. Мы не хочам быць інструментам кадавання таксама.
06Што для MOV, MKV, M4V, WebM?+
Усё падтрымваецца праз адзін конвейер. MOV асабліва — адна сямя MPEG-4, адзінавая вышука шлях. MKV з мноствам трэков аўдыё атрымліваецца адзін і той жа выбор потака UI як мультітрэковы MP4.
07Ці я могу проста дасылаць YouTube або Vimeo URL?+
Так для YouTube — ставіце даступны URL на экран загрузцы і мы выбяраем аўдыё прама, без загрузкі MP4. Vimeo патрабуе прамы файл або пасваяны сцяга загрузцы, паколькі іх плэер закрывае поток.
08Што калі там ніхто не гаворыць, толькі музыка або B-roll?+
VAD выявляе мільчаньне і толькі музыка раздзелы і прапускае іх, таму вы не плаціца за блага амбієнта. Транскрыпцыя адзначае гэтыя дыяпазоны як `[music]` або `[no speech]` замест вынікаў словаў.

Кіньце ваш MP4. Атрымайце тэкст і SRT назад.

30 бясплатных хвілін кожны месяц. Без карты. Аўдыё вышука на боку сервера, мітка дыктарoў, заполнены SRT — усё ўключана.

Пачаць бясплатна