Whisper local / open source
ຟຣີ ຖ້າທ່ານມີ GPU ແລະ ບ່າຍບາງໂມງ. ບໍ່ມີ speaker diarization ໂດຍຄົ່ນດຽວ.
ວາງ ແຟ້ມ MP3 ໃນອັດຕາໃດໜຶ່ງ ຈາກ 64 ຫາ 320 kbps. ໄດ້ຮັບເອກະສານອ້າງອີງເວລາ ມີປ້າຍລໍາພູ່ ໃນ 99 ພາສາ — ບໍ່ຕ້ອງແປງຮູບແບບ, ບໍ່ຕ້ອງເຊີນໃໝ່, ບໍ່ຕ້ອງລໍາຕົວ.
MP3 · WAV · M4A · MP4 · MOV · MKV · OGG · OPUS · FLAC · WEBM — up to 100 MB anonymously
YouTube · TikTok · Vimeo · Twitter · SoundCloud · Spotify · 50+ more
↓ ເບິ່ງວ່າໄດ້ຫຍັງອອກມາ
ພວກເຮົາອ່ານ ຫົວ MP3 ໂດຍກົງ — VBR, CBR, joint-stereo, encoder ໃດໜຶ່ງ (LAME, Fraunhofer, FFmpeg). ຖ້າວ່າແຟ້ມເປັນ stereo ທີ່ແທ້ຈິງ ມີລໍາພູ່ໃນຊ່ອງໂຊ່ວແຍກຕ່າງຫາກ, ພວກເຮົາໃຊ້ສິ່ງນັ້ນເພື່ອແບ່ງສຽງ. Mono mix-down ກັບຄືນເປັນ acoustic diarization.
ເມື່ອໃດທີ່ທ່ານເລີ່ມຮູ້ວ່າ archive ບໍ່ສົມບູນ?
ອາດຈະປະມານ 2019, ເມື່ອພວກເຮົາເລີ່ມລາຍອອກ reel-to-reels.
ແລະ ແຟ້ມທີ່ຫາຍໄປ — ມີການບັນທຶກໄວ້ບ່ໍ?
ມີ index ເຈ້ຍລາຍລະອຽດ ຈາກ '78, ແຕ່ເຄິ່ງນຶ່ງຖືກນ້ໍາເສຍຫາຍ.
↓ This is the dashboard
Same layout as the real dashboard — Summary, full Transcript, Speakers tab, Exports. Key points and action items extracted automatically. Auto-tags on every job.
Sample preview from a founder interview about post-call workflow. Real transcripts look exactly like this — same tabs, same summary block, same key-points / action-items split, same auto-tag chips.
ສາມທາງເລືອກທີ່ແທ້ຈິງ · ການປຽບທຽບທີ່ຊື່ສັດ
ທ່ານສາມາດເລີ່ມຕົ້ນ Whisper ໃນ laptop ຂອງທ່ານເອງ ຟຣີ ຖ້າທ່ານມີທັກສະ. Otter ແລະ Sonix ຍອມຮັບ MP3 ອັບໂຫລດ ໃນ dashboard ສະ subscription. ພວກເຮົາເອົາແຟ້ມ, ສົ່ງເອກະສານ, ແລະ ບໍ່ບັງຄັບໃຫ້ທ່ານອາໄສຢູ່ໃນ UI.
ຟຣີ ຖ້າທ່ານມີ GPU ແລະ ບ່າຍບາງໂມງ. ບໍ່ມີ speaker diarization ໂດຍຄົ່ນດຽວ.
ວາງ MP3. ໄດ້ຮັບເອກະສານທີ່ມີປ້າຍລໍາພູ່ ເກືອບເວລາຈິງ × 0.025.
Dashboard ທີ່ເລື່ອມລ층, ສາຍເດືອນ cap, ສໍາລັບພາສາ English. ການອັບໂຫລດຟາຍ ຮູ້ສຶກເສມືອນວ່າເປັນລັກສະນະດ້ານຂ້າງ.
ລາຄາ ແລະ ຄວາມພ້ອມໃຈຂອງ feature ຖືກຕ້ອງ ປະມານ May 2026. ປະສິດຕິພາບ Whisper ແຕກຕ່າງກັນ ຕາມຂະໜາດ model ແລະ hardware.
ໂດຍສະເພາະ ກັບ MP3
MP3 ເປັນ format, ບໍ່ແມ່ນ recording style — ໂຄ, ທໍາ failure modes ມາ��າກ encoder, ບໍ່ແມ່ນ speech.
Default ທີ່ fit ປະມານ 80% ຂອງ MP3 files. Override per-job ຈາກ form.
Accuracy · real-world numbers
ຄວາມຖືກຕ້ອງ MP3 ຖືກຜູກມັດ ໂດຍ ສິ່ງທີ່ encoder ຮັກສາໄວ້, ບໍ່ແມ່ນໂດຍພວກເຮົາ. ການບີບອັດ perceptual ຂ້າງເທິງ ປະມານ 96 kbps ຮັກສາ speech intelligibility ໍ່ຫຼາຍ; ຕ່ໍາກວ່າ 64 kbps, sibilants ແລະ consonants ເລີ່ມລະລາຍ. ຕົວເລ��� ລຸ່ມນີ້ ມາຈາກ customer MP3 ທີ່ແທ້ຈິງ ໃນ production.
ກາບໃກ້ lossless ສໍາລັບ speech. Podcast master, dictation app exports, interview rig ວິສະວະກຳ. Diarization ສະອາດ ຖ້າວ່າ speaker ຢູ່ໃນ channel ແຍກຕ່າງຫາກ.
ອັດຕາບິດທົ່ວໄປທີ່ສຸດ ສໍາລັບ spoken-word MP3. Zoom exports, Riverside downloads, voice recorder default. ສິ່ງປະດິດ compression ບໍ່ໄດ້ຍິນ ໂດຍ recognizer.
Voice memo default ໃນ phone ສ່ວນຫຼາຍ. Acoustic diarization ຈັດການ 2-4 speakers. ຕົວເລກ ແລະ ຊື່ເພື່ອຕົວ ບາງຄັ້ງ ຕ້ອງການ glance.
ປະໂຫຍກກ່ົາວເກົ່າ answering-machine, lecture archives, narrow-band sources. ສຽງ consonant ຄວາມຖີ່ສູງ (f/s/sh) ມົວ. ຍັງສາມາດອ່ານໄດ້ — ວາງແຜນ proofread.
ຄໍາຖາມທົ່ວໄປ
ຟຣີ 30 ນາທີ ທຸກໆເດືອນ. ບໍ່ຕ້ອງບັດ. ປ້າຍລໍາພູ່, 99 ພາສາ, ທຸກ export format ລວມ.
ເລີ່ມຟຣີ