MP3-ஐ உரையாக மாற்றுங்கள்.பேச்சாளர் லேபிள்கள், 100+ மொழிகள்.

64 முதல் 320 kbps வரை எந்த bitrate-லும் ஒரு MP3 கோப்பை இடுங்கள். 99 மொழிகளில் டைம்ஸ்டாம்ப் மற்றும் பேச்சாளர் லேபிள் கொண்ட டிரான்ஸ்கிரிப்ட்டைப் பெறுங்கள் — வடிவ மாற்றம் இல்லை, மறு-encode இல்லை, வரிசையில் காத்திருப்பு இல்லை.

உங்கள் ஆடியோ அல்லது வீடியோவை இடுங்கள்

MP3 · WAV · M4A · MP4 · MOV · MKV · OGG · OPUS · FLAC · WEBM — up to 100 MB anonymously

Paste a link, we’ll fetch the audio

YouTube · TikTok · Vimeo · Twitter · SoundCloud · Spotify · 50+ more

உங்கள் browser-இலிருந்தே நேரடியாக record செய்யுங்கள்

Sign up 30 விநாடிகள் — அதன் பின் dashboard-இல் உடனே recording திறக்கும்.

No card required~90s per 60-min fileSRT · VTT · DOCX · TXTகோப்புகள் 24 மணி நேரத்தில் தானாக நீக்கப்படும்

↓ வெளியே வருவதைப் பாருங்கள்

MP3 உள்ளே. டையரைஸ் செய்யப்பட்ட டிரான்ஸ்கிரிப்ட் வெளியே.

நாங்கள் MP3 frame headers-ஐ நேரடியாக வாசிக்கிறோம் — VBR, CBR, joint-stereo, எந்த encoder ஆனாலும் (LAME, Fraunhofer, FFmpeg). கோப்பு உண்மையான stereo-வாக இருந்து, பேச்சாளர்கள் தனித்தனி channel-களில் இருந்தால், குரல்களைப் பிரிக்க அதைப் பயன்படுத்துகிறோம். Mono mix-down-க்கு acoustic diarization பயன்படுத்தப்படும்.

interview-tape-04.mp3REC 192 kbps · stereo · 38:42
தானாக கண்டறியப்பட்டது en-GB44.1 kHz · LAME 3.100
~90s
டிரான்ஸ்கிரிப்ட் · streaming95% துல்லியம்
S1

சரி, காப்பகம் முழுமையடையாதது என்பதை நீங்கள் முதலில் எப்போது உணர்ந்தீர்கள்?

S2

ரீல்-டு-ரீல்களை டிஜிட்டலாக்கத் தொடங்கியபோது, 2019-ல் இருக்கலாம்.

S1

காணாமல் போன டேப்புகள் — அவை எங்காவது பட்டியலிடப்பட்டிருந்தனவா?

S2

'78-ல் இருந்து ஒரு காகித அட்டவணை உள்ளது, ஆனால் அதில் பாதி தண்ணீரால் சேதமாகியுள்ளது.

192 kbps stereo-வில் 95%SRT · DOCX · TXT · JSON · VTT

↓ This is the dashboard

This is what loads when the job finishes.

Same layout as the real dashboard — Summary, full Transcript, Speakers tab, Exports. Key points and action items extracted automatically. Auto-tags on every job.

Try it on your own file — it's free

மூன்று உண்மையான விருப்பங்கள் · நேர்மையான ஒப்பீடு

இலவச லோக்கல் Whisper. Otter அல்லது Sonix. அல்லது நாங்கள்.

நீங்கள் தொழில்நுட்பத்தில் தேர்ந்தவராக இருந்தால், உங்கள் சொந்த laptop-ல் Whisper-ஐ இலவசமாக இயக்கலாம். Otter மற்றும் Sonix ஆகியவை சந்தா dashboard-களுக்குள் MP3 பதிவேற்றங்களை ஏற்கின்றன. நாங்கள் கோப்பை எடுத்து, டிரான்ஸ்கிரிப்ட்டை திருப்பித் தருகிறோம் — UI-க்குள் நீங்கள் வாழ வேண்டிய அவசியமில்லை.

Option 01

Whisper local / open source

உங்களிடம் GPU மற்றும் ஒரு மதியம் இருந்தால் இலவசம். Out of the box speaker diarization இல்லை.

அமைப்புPython + CUDA + 10 GB models
Speaker diarizationசேர்க்கப்படவில்லை (pyannote add-on)
வேகம் · 1 மணி நேர MP3consumer GPU-வில் 5–40 நிமிடம்
மொழிகள்99, ஆனால் tiny model 80%-க்கு கீழே விழும்
ExportTXT / SRT / VTT / JSON
செலவுஇலவசம் + உங்கள் மின்சாரம்
Best forஏற்கனவே GPU வைத்திருக்கும், பேச்சாளர் லேபிள்கள் தேவையில்லாத, முழு லோக்கல் தனியுரிமை விரும்பும் engineer-கள்.
Option 02

Transcription.Solutions

MP3-ஐ இடுங்கள். கிட்டத்தட்ட real-time × 0.025-ல் பேச்சாளர் லேபிள் கொண்ட உரையை திரும்பப் பெறுங்கள்.

அமைப்புDrag-and-drop, முயற்சி செய்ய account தேவையில்லை
Speaker diarizationஉள்ளமைக்கப்பட்டது (Pro & Business திட்டங்கள்)
வேகம் · 1 மணி நேர MP3~90 வினாடிகள்
மொழிகள்99, தானாக கண்டறியப்படும்
ExportSRT · VTT · DOCX · TXT · JSON
செலவு · ஒரு நிமிடத்திற்கு$0.03
Best forMP3 வைத்திருக்கும் எவருக்கும் — journalist tape, podcast export, voice memo, archival dub — மறு முனையில் துல்லியமான உரை வேண்டுபவர்களுக்கு.
Option 03

Otter / Sonix

மெருகூட்டப்பட்ட dashboard, மாதாந்திர நிமிடங்கள் வரம்பு, ஆங்கிலத்துக்கு tuned. கோப்பு பதிவேற்றம் ஒரு side feature போல உணரப்படும்.

அமைப்புAccount + கட்டண திட்டம்
Speaker diarizationAcoustic, EN-சார்பு
வேகம் · 1 மணி நேர MP3வரிசையில் 5–10 நிமிடம்
மொழிகள்Otter EN-மட்டும்; Sonix ~40
Exportகட்டண அடுக்குகளுக்குப் பின்னால் பூட்டப்பட்டுள்ளது
செலவுமாதம் $17+ அல்லது $10+/மணி (Sonix)
Best forசுத்தமான API-style file→text flow-ஐ விட டிரான்ஸ்கிரிப்ட் editor மற்றும் collaboration UI விரும்பும் குழுக்கள்.

விலை மற்றும் feature கிடைப்பு மே 2026 நிலவரப்படி துல்லியமானது. Whisper செயல்திறன் model size மற்றும் hardware-ஐப் பொறுத்து மாறுபடும்.

MP3-க்கு குறிப்பானது

மக்களை தொந்தரவு செய்யும் மூன்று விஷயங்கள். பொதுவான டிரான்ஸ்கிரிப்ஷன் கருவிகளில்

MP3 என்பது ஒரு வடிவம், பதிவு பாணி அல்ல — அதாவது failure modes encoder-லிருந்து வருகின்றன, பேச்சிலிருந்து அல்ல.

எது தவறாகப் போகிறது

  1. 1VBR headers தவறாக parse செய்யப்படுகின்றன. சில கருவிகள் variable-bitrate MP3-களை fixed-rate ஆக படித்து duration-ஐ தவறாக கணக்கிடுகின்றன — ஒரு மணி நேர கோப்பில் timestamps நிமிடங்களாக drift ஆகும்.
  2. 2Joint-stereo பதிவேற்ற preprocessing-ன் போது mono-வாக தட்டையாக்கப்படும். கோப்பில் உண்மையில் இருந்த per-speaker channel separation-ஐ நீங்கள் இழக்கிறீர்கள்.
  3. 3உட்பொதிக்கப்பட்ட ID3 album art ஒரு சில uploaders-ஐ தடுமாற வைக்கிறது — அவை கோப்பை 'pure audio இல்லை' என நிராகரிக்கின்றன அல்லது அதை அகற்றி மீண்டும் encode செய்து தரத்தை மேலும் குறைக்கின்றன.

அதற்கு பதிலாக நாங்கள் என்ன செய்கிறோம்

  1. 1Xing/LAME header இருக்கும்போது அதையும், இல்லாதபோது frame-count fallback-ஐயும் பயன்படுத்துகிறோம். VBR timestamps பல மணி நேர கோப்புகள் முழுவதும் ±0.1 s வரை துல்லியமாக இருக்கும்.
  2. 2Joint-stereo மற்றும் true-stereo MP3-கள் diarization-க்கு முன் L/R PCM-ஆக decode செய்யப்படுகின்றன. உங்கள் பேச்சாளர்கள் pan செய்யப்பட்டிருந்தால், நாங்கள் அவர்களைப் பிரித்தே வைக்கிறோம்.
  3. 3ID3v1, ID3v2, APE tags, உ���்பொதிக்கப்பட்ட art — அனைத்தும் தொடாமல் கடத்தப்படுகின்றன. உங்கள் MP3-ஐ நாங்கள் ஒருபோதும் மீண்டும் encode செய்வதில்லை.

MP3 பதிவேற்றங்களுக்கான பரிந்துரைக்கப்பட்ட job அமைப்புகள்

~80% MP3 கோப்புகளுக்கு பொருந்தும் defaults. form-லிருந்து per-job override செய்யுங்கள்.

Decoder
Frame-accurate, மீண்டும் encode இல்லை
Diarization
stereo எனில் channel split, இல்லையெனில் acoustic
Speaker model
Auto · 1-12 பேச்சாளர்கள்
மொழி
முதல் 30 s-லிருந்து தானாக கண்டறியப்படும்
Filler words
அகற்றப்பட்டது (வைத்திருக்க toggle)
Export bundle
DOCX + SRT + timestamped TXT

Accuracy · real-world numbers

192 kbps stereo-வில் 95%+. 64 kbps மோனோ வரை பயன்படுத்தத்தக்கது.

MP3 துல்லியம் encoder எதை வைத்திருந்தது என்பதால் வரம்பு செய்யப்படுகிறது, எங்களால் அல்ல. ~96 kbps-க்கு மேல் perceptual compression பேச்சு புரிதலை மிகச் சிறப்பாகப் பாதுகாக்கிறது; 64 kbps-க்கு கீழே, sibilants மற்றும் consonants கரையத் தொடங்குகின்றன. கீழே உள்ள எண்கள் production-ல் உள்ள உண்மையான வாடிக்கையாளர் MP3-களில் இருந்து.

96%
320 kbps stereo, studio மூலம்

பேச்சுக்கு கிட்டத்தட்ட lossless. Podcast masters, dictation app exports, தொழில்முறை interview rigs. பேச்சாளர்கள் தனித்தனி channel-களில் இருந்தால் diarization சுத்தமாக இருக்கும்.

95%
192 kbps stereo, 2-3 பேச்சாளர்கள்

Spoken-word MP3-களுக்கு மிகவும் பொதுவான bitrate. Zoom exports, Riverside downloads, voice recorder defaults. Compression artifacts recognizer-க்கு கேட்கவில்லை.

91%
128 kbps mono, உரையாடல்

பெரும்பாலான தொலைபேசிகளில் voice memo defaults. Acoustic diarization 2-4 பேச்சாளர்களைக் கையாள்கிறது. எண்கள் மற்றும் proper nouns அவ்வப்போது ஒரு பார்வை தேவை.

84%
64 kbps mono, archival / phone-dump

பழைய answering-machine rips, lecture archives, narrow-band sources. High-frequency consonants (f/s/sh) மங்குகின்றன. இன்னும் படிக்கக்கூடியது — proofread-க்கு திட்டமிடுங்கள்.

பொதுவான கேள்விகள்

மக்கள் கேட்கும் 8 விஷயங்கள். MP3 டிரான்ஸ்கிரிப்ஷன் பற்றி

01பயன்படுத்தத்தக்க டிரான்ஸ்கிரிப்ட்டை இன்னும் தரக்கூடிய குறைந்தபட்ச MP3 bitrate என்ன?+
64 kbps நடைமுறை தரை. அதற்கு கீழே, sibilants (s, sh, f) noise-ஆக compress ஆகி word error rate 20%-ஐ தாண்டுகிறது. நீங்கள் புதிதாக பதிவு செய்தால், 128 kbps mono அல்லது 192 kbps stereo-ஐ இலக்காக கொள்ளுங்கள் — அதற்கு மேல் எதுவும் பேச்சுக்கு அளவுக்கு அதிகமாக இருக்கும்.
02என் MP3-ஐ முதலில் WAV-ஆக மாற்ற வேண்டுமா?+
வேண்டாம். MP3 → WAV மீண்டும் encode செய்வது சுழியம் துல்லியம் சேர்க்கிறது, ஏனெனில் encoder நிராகரித்த data நிரந்தரமாகப் போய்விட்டது. MP3-ஐ நேரடியாக பதிவேற்றுங்கள். நாங்கள் memory-ல் frames-ஐ decode செய்து PCM-ஐ recognizer-க்கு feed செய்கிறோம்.
03Stereo MP3 mono-வை விட சிறந்த பேச்சாளர் லேபிள்களை எனக்குத் தருமா?+
பேச்சாளர்கள் உண்மையில் தனித்தனி channel-களில் பதிவு செய்யப்பட்டிருந்தால் மட்டுமே — பெரும்பாலான stereo MP3-களில் இரு பக்கங்களிலும் ஒரே ஆடியோ உள்ளது ('dual mono') மற்றும் எதையும் பெறவில்லை. உண்மையான channel-split (உதாரணமாக Riverside exports, two-mic field rigs) acoustic diarization-ஐ தவிர்த்து பேச்சாளர்களை கிட்டத்தட்ட சரியாக லேபிள் செய்ய அனுமதிக்கிறது.
04நீங்கள் ஏற்கும் அதிகபட்ச MP3 கோப்பு அளவு என்ன?+
ஒரு பதிவேற்றத்திற்கு 5 GB, அதாவது 192 kbps-ல் சுமார் 60 மணி அல்லது 128 kbps-ல் 90 மணி. உங்கள் கோப்பு பெரியதாக இருந்தால் chunked upload காட்டுவோம் — நீங்களாக பிரிக்க தேவையில்லை.
0560-நிமிட MP3-ஐ டிரான்ஸ்கிரைப் செய்ய எவ்வளவு நேரம் ஆகும்?+
Bitrate-ஐப் பொருட்படுத்தாமல், upload-complete-லிருந்து transcript-ready வரை பொதுவாக 90 வினாடிகள். MP3 frames-ஐ decode செய்வது வேகமானது; நேரம் recognizer-ல் உள்ளது. பல-பேச்சாளர் கோப்புகளில் diarization 5-10 வினாடிகளைச் சேர்க்கிறது.
06என் MP3-ல் background music உள்ளது — டிரான்ஸ்கிரிப்ட் கெட்டுவிடுமா?+
பேச்சின் கீழ் அமைதியான bed music பரவாயில்லை. குரலுடன் போட்டியிடும் சத்தமான music (intro stings, interview-களுக்கு கீழே scoring) சில நேரங்களில் ஒன்றுடன் ஒன்று சேர்ந்த syllables-ல் தவறான recognition-ஐ ஏற்படுத்துகிறது. முன்-filter செய்ய job form-ல் music suppression-ஐ toggle செய்யுங்கள்.
07தொலைபேசி voicemail அல்லது answering machines-லிருந்து rip செய்யப்பட்ட MP3-களை நீங்கள் கையாள முடியுமா?+
ஆம், ஆனால் இவை பெரும்பாலும் 8 kHz narrow-band ஆக MP3-ஆக மீண்டும் encode செய்யப்பட்டவை — ஆடியோ தர உச்சவரம்பு அசல் PSTN capture-ஆல் அமைக்கப்படுகிறது, MP3 wrapper-ஆல் அல்ல. அத்தகைய source-ல் 78-85% துல்லியம் எதிர்பாருங்கள், அதே அடிப்படையான call-லும் நாங்கள் பெறுவோம்.
08டிரான்ஸ்கிரிப்ட் முடிந்த பிறகு என் MP3-ஐ நீங்கள் வைத்திருப்பீர்களா?+
கோப்புகள் default-ஆக 30 நாட்களுக்குப் பிறகு நீக்கப்படும், அல்லது dashboard வழியாக கோரிக்கையின் பேரில் உடனடியாக நீக்கப்படும். நீங்கள் நீக்கும் வரை டிரான்ஸ்கிரிப்ட் உங்கள் account-ல் இருக்கும். எந்த model-ஐயும் train செய்ய நாங்கள் வாடிக்கையாளர் ஆடியோவைப் பயன்படுத்துவதில்லை — எப்போதும்.

உங்கள் MP3-ஐ இடுங்கள். 90 வினாடிகளில் உரையை திரும்பப் பெறுங்கள்.

ஒவ்வொரு மாதமும் 30 இலவச நிமிடங்கள். கார்டு தேவையில்லை. பேச்சாளர் லேபிள்கள், 99 மொழிகள், அனைத்து export வடிவங்களும் சேர்க்கப்பட்டுள்ளன.

இலவசமாகத் தொடங்குங்கள்