MP3-ді мәтінге стенограммалаңыз.Сөйлеушінің белгілері, 100+ тіл.

MP3 файлын 64-тен 320 kbps-қа дейін кез келген битрейтте салыңыз. 99 тілде уақыт белгісі және сөйлеушінің белгісімен стенограмма алыңыз — формат түрленуі жоқ, қайта кодтау жоқ, кезектеу жоқ.

Аудио немесе видеоны тастаңыз

MP3 · WAV · M4A · MP4 · MOV · MKV · OGG · OPUS · FLAC · WEBM — up to 100 MB anonymously

Paste a link, we’ll fetch the audio

YouTube · TikTok · Vimeo · Twitter · SoundCloud · Spotify · 50+ more

Браузерден тікелей жазып алыңыз

Тіркелу 30 секунд алады — содан кейін бірден дашбордта жазу ашылады.

No card required~90s per 60-min fileSRT · VTT · DOCX · TXTФайлдар 24 сағаттан кейін автоматты өшеді

↓ Нәтижесін көріңіз

MP3 іріктіңіз. Дауыс ажырату стенограммасы шығады.

Біз MP3 кадр үстіңгілерін тікелей оқимыз — VBR, CBR, joint-stereo, кез келген кодтеген (LAME, Fraunhofer, FFmpeg). Егер файл сөйлеушілері әр түрлі арналарда болса, оны дауыстарды бөлу үшін пайдаланамыз. Моно қосындысы акустикалық дауыс ажыратуына ауысады.

interview-tape-04.mp3REC 192 kbps · stereo · 38:42
автоды en-GB болып анықталды44.1 kHz · LAME 3.100
~90s
Стенограмма · ағындық95% дәлдігі
S1

Архив толық емес екенін қашан білдіңіз?

S2

Шамамен 2019 жылы, катушкалар-катушкаларды цифрлеуді бастағанда.

S1

Ал жоқ болып кеткен балаларды бір жерде тіркедік пе?

S2

1978 жылдың қағаз индексі бар, бірақ оның жартысы су зақымдаған.

192 kbps stereo-да 95%SRT · DOCX · TXT · JSON · VTT

↓ This is the dashboard

This is what loads when the job finishes.

Same layout as the real dashboard — Summary, full Transcript, Speakers tab, Exports. Key points and action items extracted automatically. Auto-tags on every job.

Try it on your own file — it's free

Үш шынайы нұсқа · щырлы салыстыру

Тегін жергілік Whisper. Otter немесе Sonix. Немесе біз.

Техникалык болсаңыз, ноутбукыңызда Whisper-ді тегін іске қоса аласыз. Otter ж��не Sonix абонелік панельінде MP3 төмендететін болды. Біз файлды аламыз, стенограмманы қайтарамыз және пайдалау интерфейсінің ішінде жүргеу қажет емес.

Option 01

Whisper жергілік / ашық бастапқы

GPU және бір сағат болса тегін. Сөйлеушінің дауыс ажыратуы орындалмайды.

ОрнатуPython + CUDA + 10 GB модельдері
Сөйлеушінің дауыс ажыратуыҚосымта жоқ (pyannote қосымшасы)
Қызу · 1 сағ MP3Тұтынушылық GPU-та 5–40 минут
Тілдер99, бірақ шағын модель 80%-тың астында түседі
ЭкспортTXT / SRT / VTT / JSON
ҚұныТегін + сіздің электр энергиясы
Best forИнженерлер, өздерінде GPU бар, сөйлеушінің белгісі қажет емес және толық жергілік құпиялық қалайды.
Option 02

Transcription.Solutions

MP3 төмендетіңіз. Сөйлеушінің белгісімен мәтін табыңыз шамамен нақты уақыт × 0.025.

ОрнатуСүйеп қояды, сынау үшін есеп қажет емес
Сөйлеушінің дауыс ажыратуыҚабынды орнатылған (Pro & Business тарифтері)
Қызу · 1 сағ MP3~90 секунд
Тілдер99, автоды анықталған
ЭкспортSRT · VTT · DOCX · TXT · JSON
Құны · минутасына$0.03
Best forMP3-ы бар кез келген адам — журналист ленты, подкаст экспорты, дауыс естелігі, архивтік дубль — тек дәл мәтін алғысы келеді.
Option 03

Otter / Sonix

Өндіктелген панель, ай сайынғы минут шегі, ағылшын-теңгеленген. Файл төмендету қосалқы мүмкіндік сияқты көрінеді.

ОрнатуЕсеп + төлемді тариф
Сөйлеушінің дауыс ажыратуыАкустикалық, АҒ-төңіректі
Қызу · 1 сағ MP3Кезектеу 5–10 минут
ТілдерOtter АҒ ғана; Sonix ~40
ЭкспортТөлем деңгейінің артында құрғалтқы
Құны$17+/ай немесе $10+/сағ (Sonix)
Best forТөзімді группалар, стенограмма редакторы және ынамдастыру UI-ын тегіс API нәрсесі файл→мәтін ағындысынан артық қалайды.

Баға және мүмкіндік болу 2026 жылының мамырына дейін дәл. Whisper өнімділігі модель өлшемі және аппаратты қарай өзгереді.

MP3-ге құс

Жалпы стенограммалау құралдарындағы адамдарды ұстайтын үш нәрсе.

MP3 — жазба стилі емес пішім — бұл ағымдар кодтегіннен туындайды, сөйлеуден емес.

Не болғалық

  1. 1VBR үстіңгілері міс талданады. Кейбір құрал айнамалы битрейт MP3-тарын бір-ақты түрге оқып, ұзақтығын бұрыңқы есептейді — уақыт белгісі сағат ішінде минуттарға сәйкес болады.
  2. 2Birleshken-stereo төге құнарса беріңіз төмендету өндіктелігі құрықта. Файлда болған ар тараптың сөйлеушіге арналғандатар ажырауын жоғалтасыз.
  3. 3Ендіндірілген ID3 альбомды сурет бірнеше төмендегі құралдарын тіркетеді — олар файлды 'таза аудио емес' деп қабылдаймайды немесе оны сыр құрарын қайта-коддайды, дәлдігін одан әрі түсіреді.

Бір де болмаса не істейміз

  1. 1Біз Xing/LAME үстіңгісін ағ болған кезде және кадр-сан падопарылуын ағ болмаған кезде пайдаланамыз. VBR уақыт білік мен-сағат файлдарында ±0.1 с-қа дәл болып қалады.
  2. 2Joint-stereo және шынайы-stereo MP3-тар L/R PCM-ге дауыс ажырату алдында декодталады. Сіздің сөйлеушілер панель болса, оларды бөлінген сақталады.
  3. 3ID3v1, ID3v2, APE белгілер, ендіндірілген сурет — барлығы өтетілген. Біз MP3-іңізді немеме қайта-коддамаймыз.

MP3 төмендету үшін ұсынылған жұмыс параметрлері

~80% MP3 файлға сәйкес келген негі��дер. Бір бір қызмет формасынан өндітіңіз.

Декодер
Кадр-дәл, қайта-кодтау жоқ
Дауыс ажыратуы
Арналау бөлінген бөлінсе, өйтпе акуст
Сөйлеушінің модель
Авто · 1-12 сөйлеушілер
Тіл
Отқа бірінші 30 с өндіктелген
Толғындау сөздері
Өшірілген (сақтау үшін ауысуы)
Экспорт пакет
DOCX + SRT + уақыт білік TXT

Accuracy · real-world numbers

Stereo 192 kbps-та 95%+. Mono 64 kbps-та пайдаланылату.

MP3 дәлдігі кодічіде нешт сақтағаны шегіленеді, біз емес. Перцептивтік сығымдау ~96 kbps-тың үстінде сөйлеу ойлығанын өте жақсы сақтайды; 64 kbps-ты төмендіктің астында, сыбилянттар және дыбыстар ыдырай бастайды. Төмендегі сандар өндіктеу MP3-тен шыққан нақты клиент мәлімет.

96%
320 kbps stereo, студиялық көз айнасы

Сөйлеу үшін іс жүргіліксіз. Подкаст шеберлері, диктовка қолданбасы экспорттары, кәсіби сәйкестеу құрылғысы. Дауыстар дыбыстар бөлініп алынса дауыс ажыратуы таза.

95%
192 kbps stereo, 2-3 сөйлеушілер

Сөйлеген сөзді MP3 үшін ең кең бағыт. Zoom экспорттары, Riverside жүктеулері, дауыс жаздыштығының негіздері. Сығымдау артефактілері анықтағыш үшін естігісіз.

91%
128 kbps mono, сөйлестіктік

Көптеген телефондарда дауыс естелігінің негіздері. Акустикалық дауыс ажыратуу 2-4 сөйлеушілерді өндік. Сандар және өз атаулары кейде түрегелік керек.

84%
64 kbps mono, архивтік / телефон төғүлемі

Ескі жауап машинасы рипсы, лекция архивтері, тарай өндіктеігі көздері. Жоғары частота дыбыстары (f/s/sh) бұлғалады. Әлі де оқымақ — түзетуді жоспарлаңыз.

Жиі сұрақтар

8 нәрсе адамдар сұрайды. MP3 стенограммалауы туралы

01MP3 дауыстық ағныны осы пайдаланылатын стенограмманы беру үшін ең төмендегі ана қандай?+
64 kbps іс жүргіліктің төмендіктігі. Төмендіктің астында, сыбилянттар (s, sh, f) шума және сөз қателік қанағаты 20%-тан артыға өтеді. Жаңа жазап жатсаңыз, 128 kbps mono немесе 192 kbps stereo құрағыңыз — кез келген жоғарылығы сөйлеу үшін артықты.
02MP3-ті алдымен WAV-қа түрлендіру қажет пе?+
Жоқ. MP3 → WAV қайта-кодтау нөлдік дәлдік қосады, себебі кодтегін салып тастағандары мәңгі. MP3-ті тура төмендетіңіз. Біз кадрларды есте-де кодтап PCM анықтағыға берсімі.
03Stereo MP3 моноқа қарағанда жақсы сөйлеушінің белгітеді беретін пе?+
Тек сөйлеушілер шынайы түрде арнайы арналарда жазалғандағыз болса ғана — көптеген stereo MP3-тар екі тарапықта бірдей аудио ('dual mono') және ешнәрсе алмайды. Шынайы арнайы бөлінген (мысалы Riverside экспорттары, екі-микрофон далалық құрылғылар) акуст дауыс ажырату өткізіп жіберуіге және сөйлеушілерді іс-жүргіліктік формасында белгілеуге мүмкіндік береді.
04Ең көп MP3 файлдың өлшемі қай?+
Төмендету сайын 5 GB, бұл шамамен 192 kbps-та 60 сағат немесе 128 kbps-та 90 сағат. Егер файл одан да үлкен болса, біз блок-бөліндірілген төмендетуді көрсетеміз — өзіңіз бөлінуге қажет емес.
0560 минуттық MP3 стенограммалау үшін қалай ұзақ?+
әдетте 90 секунд төмендету-бітінген болған сәттен стенограмма-дайын босанша, битрейттінен қарамастан. MP3 кадрларын декодтау тез; уақыты анықтағыда. Дауыс ажыратуы көп-сөйлеушінің файлдарында 5-10 секунд қосады.
06MP3-ім фон музикасы болса — стенограмма сыналды ма?+
Сөйлеу төме тыныш аппаттағы музика өндік. Сөйлеуге ынамдастыру ыңғай музика (наурыз сарлары, балл сазы сұрағы) кейде сөйінен шамасындағы қатенесімдеуде құшындырады. Жұмыс формасындағы музика сұршелік ауысуын ағ төмендету өтекі-фильтр құрағыңыз.
07Телефон дауыс сәтті немесе жауап машинасынан рип болған MP3-ларды опер ала аласыз пе?+
Иә, бірақ олар өдетте 8 kHz тар-өндіктеігі MP3-қа қайта-коддалған — аудио дәлдігін төпе өндіктеге PSTN құру баллысы үшін органды. MP3 қоршапты тең болан үстіңгідегі анықтағыда 78-85% дәлдігін күтіңіз, құ андры барлық сөйлеуде алмасамыз.
08Стенограмма сатысынан соң MP3-ім сақтайсыңдар ма?+
Файлдар негіздеу 30 күндік сағынды өшірілген, немесе панель арқылы өндітіктен теселек өндітек. Стенограмма өндітіңіз өшірінесінше есептінде қалады. Біз клиент аудиосын модель оқытуға пайдалынбаймыз — ешқашан.

MP3-ыңызды төмендетіңіз. 90 секундта мәтін алыңыз.

Ай сайын 30 ақы минут. Карточка керек емес. Сөйлеушінің белгілері, 99 тіл, барлық экспорт пішімі қосылған.

Ақысы бастаңыз