Whisper local / open source
ឥតគិតថ្លៃ ប្រសិនបើអ្នកមាន GPU និងពេលថ្ងៃ។ គ្មាន speaker diarization ពីក្នុងប្រអប់។
ទម្លាក់ ឯកសារ MP3 នៅ bitrate ណាក៏ដោយចាប់ពី 64 ដល់ 320 kbps។ ទទួលបាន transcript ដែលមាន timestamp និង speaker labels នៅ ភាសា 99 — គ្មាន format conversion, គ្មាន re-encoding, គ្មាន ការរង់ចាំក្នុង queue។
MP3 · WAV · M4A · MP4 · MOV · MKV · OGG · OPUS · FLAC · WEBM — up to 100 MB anonymously
YouTube · TikTok · Vimeo · Twitter · SoundCloud · Spotify · 50+ more
↓ មើលលទ្ធផល
យើ្ងអាន MP3 frame headers ដោយផ្ទាល់ — VBR, CBR, joint-stereo, encoder ណាក៏ដោយ (LAME, Fraunhofer, FFmpeg)។ ប្រសិនបើឯកសារគឺ true stereo ដែលមាន speakers នៅ channels ខុសៗគ្នា, យើ្ងប្រើរឿងនេះដើម្បីបែងចែក voices។ Mono mix-down ធ្វើឱ្យវិលត្រឡប់ទៅ acoustic diarization។
ដូច្នេះ តើពេលណាដែលអ្នកដឹងថា archive មិនពេញលេញ?
ប្រហែលនៅឆ្នាំ 2019, នៅពេលដែលយើ្ងចាប់ផ្តើម digitizing reel-to-reels។
ហើយ tapes ដែលបាត់ — តើវាត្រូវបាននៅលើក្តីគណនាកន្លែងណាក៏ដោយឬ?
មាន paper index ពីឆ្នាំ '78, ប៉ុន្តែពាក់ក្នុងមួយវិនាទីវាស្ថិតក្នុងស្ថានភាព damage ដោយទឹក។
↓ This is the dashboard
Same layout as the real dashboard — Summary, full Transcript, Speakers tab, Exports. Key points and action items extracted automatically. Auto-tags on every job.
Sample preview from a founder interview about post-call workflow. Real transcripts look exactly like this — same tabs, same summary block, same key-points / action-items split, same auto-tag chips.
ជម្រើស ពិតប្រាកដ 3 · ការប្រៀបធៀប ស្មោះត្រង់
អ្នកអាចដំណើរការ Whisper នៅលើ laptop ផ្ទាល់ខ្លួនឥតគិតថ្លៃ ប្រសិនបើអ្នកមានបច្ចេកទេស។ Otter និង Sonix ទទួលយក MP3 uploads ក្នុង subscription dashboards។ យើ្งយក file, ត្រឡប់ transcript, ហើយមិនធានាឱ្យអ្នក ស្នាក់នៅក្នុង UI។
ឥតគិតថ្លៃ ប្រសិនបើអ្នកមាន GPU និងពេលថ្ងៃ។ គ្មាន speaker diarization ពីក្នុងប្រអប់។
ទម្លាក់ MP3។ ទទួលបាន speaker-labeled text ត្រឡប់មកវិញក្នុងពេលវេលា ដែលជិតដូចជា real-time × 0.025
Dashboard ក្រិតគ្រាប់, ដែនកំណត់ម៉ោងប្រចាំខែ, English-tuned។ File upload មាន احساس ដូចជា side feature។
ថ្លៃលើកលែង និង feature availability ត្រឹមត្រូវដូច្នេះ ខែឧសភា 2026។ ការងារ Whisper ខុសគ្នា ដោយ model size និង hardware។
ពិសេស ទៅលើ MP3
MP3 គឺ ទម្រង់, មិនមែន recording style — ដែលមានន័យថា failure modes មក ពី encoder, មិនមែន speech។
Defaults ដែលសមស្របលើ ~80% នៃ MP3 files។ Override ក្នុង-job ពីប្រពៃណ័។
Accuracy · real-world numbers
MP3 accuracy ត្រូវបាន bounded ដោយ អ្វីដែល encoder បានរក្សា, មិនមែន ដោយ យើ្ង។ Perceptual compression លើសពី ~96 kbps រក្សា speech intelligibility ល្អ ក្នុងលក្ខណៈច្រើន; ក្រោម 64 kbps, sibilants និង consonants ចាប់ផ្តើម dissolving។ លេខច្រើនដូចខាងក្រោម គឺ ពី real customer MP3s ក្នុង production។
ដែលជិត-lossless សម្រាប់ speech។ Podcast masters, dictation app exports, professional interview rigs។ Diarization ស្អាត ប្រសិនបើ speakers នៅលើ separate channels។
Bitrate ដែលលេចឡើង ច្រើនបំផុត សម្រាប់ spoken-word MP3s។ Zoom exports, Riverside downloads, voice recorders default។ Compression artifacts inaudible ទៅ recognizer។
Voice memo defaults នៅ phones ភាគច្រើន។ Acoustic diarization ក្បាល 2-4 speakers។ លេខ និង proper nouns ពេលខ្លះត្រូវការ glance។
Old answering-machine rips, lecture archives, narrow-band sources។ High-frequency consonants (f/s/sh) 흐려។ នៅតែ legible — ទ្រង់ទ្រាយ proofread។
សំណួរលេចធ្លាក់
30 នាទី ឥតគិតថ្លៃ រៀងរាល់ខែ។ គ្មាន card ត្រូវការ។ Speaker labels, ភាសា 99, រូបរាង export រួម។
ចាប់ផ្តើម ឥតគិតថ្លៃ