Whisper local / open source
உங்களிடம் GPU மற்றும் ஒரு மதியம் இருந்தால் இலவசம். Out of the box speaker diarization இல்லை.
64 முதல் 320 kbps வரை எந்த bitrate-லும் ஒரு MP3 கோப்பை இடுங்கள். 99 மொழிகளில் டைம்ஸ்டாம்ப் மற்றும் பேச்சாளர் லேபிள் கொண்ட டிரான்ஸ்கிரிப்ட்டைப் பெறுங்கள் — வடிவ மாற்றம் இல்லை, மறு-encode இல்லை, வரிசையில் காத்திருப்பு இல்லை.
MP3 · WAV · M4A · MP4 · MOV · MKV · OGG · OPUS · FLAC · WEBM — up to 100 MB anonymously
YouTube · TikTok · Vimeo · Twitter · SoundCloud · Spotify · 50+ more
↓ வெளியே வருவதைப் பாருங்கள்
நாங்கள் MP3 frame headers-ஐ நேரடியாக வாசிக்கிறோம் — VBR, CBR, joint-stereo, எந்த encoder ஆனாலும் (LAME, Fraunhofer, FFmpeg). கோப்பு உண்மையான stereo-வாக இருந்து, பேச்சாளர்கள் தனித்தனி channel-களில் இருந்தால், குரல்களைப் பிரிக்க அதைப் பயன்படுத்துகிறோம். Mono mix-down-க்கு acoustic diarization பயன்படுத்தப்படும்.
சரி, காப்பகம் முழுமையடையாதது என்பதை நீங்கள் முதலில் எப்போது உணர்ந்தீர்கள்?
ரீல்-டு-ரீல்களை டிஜிட்டலாக்கத் தொடங்கியபோது, 2019-ல் இருக்கலாம்.
காணாமல் போன டேப்புகள் — அவை எங்காவது பட்டியலிடப்பட்டிருந்தனவா?
'78-ல் இருந்து ஒரு காகித அட்டவணை உள்ளது, ஆனால் அதில் பாதி தண்ணீரால் சேதமாகியுள்ளது.
↓ This is the dashboard
Same layout as the real dashboard — Summary, full Transcript, Speakers tab, Exports. Key points and action items extracted automatically. Auto-tags on every job.
Sample preview from a founder interview about post-call workflow. Real transcripts look exactly like this — same tabs, same summary block, same key-points / action-items split, same auto-tag chips.
மூன்று உண்மையான விருப்பங்கள் · நேர்மையான ஒப்பீடு
நீங்கள் தொழில்நுட்பத்தில் தேர்ந்தவராக இருந்தால், உங்கள் சொந்த laptop-ல் Whisper-ஐ இலவசமாக இயக்கலாம். Otter மற்றும் Sonix ஆகியவை சந்தா dashboard-களுக்குள் MP3 பதிவேற்றங்களை ஏற்கின்றன. நாங்கள் கோப்பை எடுத்து, டிரான்ஸ்கிரிப்ட்டை திருப்பித் தருகிறோம் — UI-க்குள் நீங்கள் வாழ வேண்டிய அவசியமில்லை.
உங்களிடம் GPU மற்றும் ஒரு மதியம் இருந்தால் இலவசம். Out of the box speaker diarization இல்லை.
MP3-ஐ இடுங்கள். கிட்டத்தட்ட real-time × 0.025-ல் பேச்சாளர் லேபிள் கொண்ட உரையை திரும்பப் பெறுங்கள்.
மெருகூட்டப்பட்ட dashboard, மாதாந்திர நிமிடங்கள் வரம்பு, ஆங்கிலத்துக்கு tuned. கோப்பு பதிவேற்றம் ஒரு side feature போல உணரப்படும்.
விலை மற்றும் feature கிடைப்பு மே 2026 நிலவரப்படி துல்லியமானது. Whisper செயல்திறன் model size மற்றும் hardware-ஐப் பொறுத்து மாறுபடும்.
MP3-க்கு குறிப்பானது
MP3 என்பது ஒரு வடிவம், பதிவு பாணி அல்ல — அதாவது failure modes encoder-லிருந்து வருகின்றன, பேச்சிலிருந்து அல்ல.
~80% MP3 கோப்புகளுக்கு பொருந்தும் defaults. form-லிருந்து per-job override செய்யுங்கள்.
Accuracy · real-world numbers
MP3 துல்லியம் encoder எதை வைத்திருந்தது என்பதால் வரம்பு செய்யப்படுகிறது, எங்களால் அல்ல. ~96 kbps-க்கு மேல் perceptual compression பேச்சு புரிதலை மிகச் சிறப்பாகப் பாதுகாக்கிறது; 64 kbps-க்கு கீழே, sibilants மற்றும் consonants கரையத் தொடங்குகின்றன. கீழே உள்ள எண்கள் production-ல் உள்ள உண்மையான வாடிக்கையாளர் MP3-களில் இருந்து.
பேச்சுக்கு கிட்டத்தட்ட lossless. Podcast masters, dictation app exports, தொழில்முறை interview rigs. பேச்சாளர்கள் தனித்தனி channel-களில் இருந்தால் diarization சுத்தமாக இருக்கும்.
Spoken-word MP3-களுக்கு மிகவும் பொதுவான bitrate. Zoom exports, Riverside downloads, voice recorder defaults. Compression artifacts recognizer-க்கு கேட்கவில்லை.
பெரும்பாலான தொலைபேசிகளில் voice memo defaults. Acoustic diarization 2-4 பேச்சாளர்களைக் கையாள்கிறது. எண்கள் மற்றும் proper nouns அவ்வப்போது ஒரு பார்வை தேவை.
பழைய answering-machine rips, lecture archives, narrow-band sources. High-frequency consonants (f/s/sh) மங்குகின்றன. இன்னும் படிக்கக்கூடியது — proofread-க்கு திட்டமிடுங்கள்.
பொதுவான கேள்விகள்
ஒவ்வொரு மாதமும் 30 இலவச நிமிடங்கள். கார்டு தேவையில்லை. பேச்சாளர் லேபிள்கள், 99 மொழிகள், அனைத்து export வடிவங்களும் சேர்க்கப்பட்டுள்ளன.
இலவசமாகத் தொடங்குங்கள்