תרגום MP3 לטקסט.זיהוי דובר, 100+ שפות.

זרוק קובץ MP3 בכל bitrate מ-64 עד 320 kbps. קבל תמליל עם חותמות זמן וזיהוי דובר ב-99 שפות — ללא המרת פורמט, ללא re-encoding, ללא המתנה בתור.

גרור לכאן אודיו או וידאו

MP3 · WAV · M4A · MP4 · MOV · MKV · OGG · OPUS · FLAC · WEBM — up to 100 MB anonymously

Paste a link, we’ll fetch the audio

YouTube · TikTok · Vimeo · Twitter · SoundCloud · Spotify · 50+ more

להקליט ישר מהדפדפן

הרשמה לוקחת 30 שניות — ההקלטה נפתחת מיד אחר כך, בתוך הדאשבורד.

No card required~90s per 60-min fileSRT · VTT · DOCX · TXTקבצים נמחקים תוך 24 שעות

↓ ראה מה יוצא

MP3 פנימה. תמליל עם זיהוי דובר החוצה.

אנחנו קוראים את כותרות מסגרת MP3 ישירות — VBR, CBR, joint-stereo, כל מקודד (LAME, Fraunhofer, FFmpeg). אם הקובץ הוא סטריאו אמיתי עם דוברים בערוצים נפרדים, אנחנו משתמשים בזה כדי לפצל קולות. mono mix-down חוזר ל-diarization אקוסטי.

interview-tape-04.mp3REC 192 kbps · סטריאו · 38:42
en-GB בזיהוי אוטומטי44.1 kHz · LAME 3.100
~90s
תמליל · streamingדיוק של 95%
S1

אז מתי בדיוק הבנת שהארכיון לא שלם?

S2

כנראה בסביבות 2019, כשהתחלנו לדיגיטליזציה של הסלילים.

S1

והסלילים החסרים — הם עובדו בקטלוג איפהשהוא?

S2

יש אינדקס על נייר מ-78, אבל חצי ממנו ניזוק למים.

95% על 192 kbps סטריאוSRT · DOCX · TXT · JSON · VTT

↓ This is the dashboard

This is what loads when the job finishes.

Same layout as the real dashboard — Summary, full Transcript, Speakers tab, Exports. Key points and action items extracted automatically. Auto-tags on every job.

Try it on your own file — it's free

שלוש אפשרויות אמיתיות · השוואה כנה

Whisper מחינם. Otter או Sonix. או אנחנו.

אתה יכול להריץ Whisper בלפטופ שלך בחינם אם אתה טכני. Otter ו-Sonix מקבלים העלאות MP3 בתוך לוחות בקרה בתמיסה. אנחנו לוקחים את הקובץ, מחזירים את התמליל, ולא גורמים לך לחיות בתוך ממשק משתמש.

Option 01

Whisper מקומי / קוד פתוח

חינם אם יש לך GPU וערב. אין diarization שחקן מהקופסה.

הקמהPython + CUDA + מודלים בגודל 10 GB
זיהוי דוברלא כלול (תוסף pyannote)
מהירות · 1 שעה MP35–40 דקות על GPU צרכני
שפות99, אבל מודל קטן שחור מתחת ל-80%
ייצואTXT / SRT / VTT / JSON
עלותחינם + החשמל שלך
Best forמהנדסים שכבר בעלים GPU, לא צריכים תוויות דובר, וצריכים פרטיות מקומית מלאה.
Option 02

Transcription.Solutions

זרוק את ה-MP3. קבל טקסט עם זיהוי דובר בחזרה בערך בזמן אמת × 0.025.

הקמהגרירה והנחה, אין צורך בחשבון כדי לנסות
זיהוי דוברמובנה (תוכניות Pro ו-Business)
מהירות · 1 שעה MP3~90 שניות
שפות99, ב��יהוי אוטומטי
ייצואSRT · VTT · DOCX · TXT · JSON
עלות · לדקה$0.03
Best forמישהו עם MP3 — קלטת עיתונאי, ייצוא podcast, פתק קול, דובינג ארכיוני — שפשוט רוצה טקסט מדויק בצד השני.
Option 03

Otter / Sonix

לוח בקרה מלוטש, מגבלת דקות חודשית, כוונון אנגלית לאנגלית. העלאת קובץ מרגישה כמו תכונה משנית.

הקמהחשבון + תוכנית בתשלום
זיהוי דובראקוסטי, EN-leaning
מהירות · 1 שעה MP35–10 דקות בתור
שפותOtter EN-only; Sonix ~40
ייצואנעול מאחורי טיירים בתשלום
עלות$17+/חודש או $10+/שעה (Sonix)
Best forצוותים שרוצים עורך תמליל וממשק שיתוף פעולה יותר מאשר זרימת API ניקיון קובץ → טקסט.

תמחור וזמינות תכונות מדויקות ליולי 2026. ביצועי Whisper משתנים לפי גודל מודל וחומרה.

ספציפי ל-MP3

שלוש דברים שנושכים אנשים בכלים דירוג גלי.

MP3 הוא פורמט, לא סגנון הקלטה — מה שאומר שאופני הכישלון באים מהמקודד, לא מהדיבור.

מה הולך רע

  1. 1כותרות VBR מקבלות mis-parsed. כמה כלים קוראים MP3s בביטריט משתנה כביטריט קבוע וגם miscalculate משך — חותמות זמן סחף לפי דקות על פני שעה ארוכה קובץ.
  2. 2Joint-stereo מקבל משייט ל-mono במהלך העלאה preprocessing. אתה מאבד את הפרדת הערוץ לדובר שהיתה בפועל בקובץ.
  3. 3ID3 embedded אלבום אמנות משפעות כמה uploaders — הם דוחים את הקובץ כ'לא pure audio' או רצועה זה ו-re-encode, זורקים איכות עוד יותר.

מה אנחנו עושים במקום

  1. 1אנחנו משתמשים בכותרת Xing/LAME כשהיא קיימת וספירת מסגרת fallback כשהיא לא. חותמות זמן VBR נשארות מדויקות ל-±0.1 s על פני קבצים רב-שעתיים.
  2. 2Joint-stereo ו-true-stereo MP3s הם מפוענח ל-L/R PCM לפני diarization. אם הדוברים שלך היו panned, אנחנו שומרים אותם split.
  3. 3ID3v1, ID3v2, APE tags, embedded art — הכל עברו untouched. אנחנו אף פעם לא re-encode את ה-MP3 שלך.

הגדרות עבודה מומלצות לעלאות MP3

ברירות דברים שמתאימות ~80% של קבצי MP3. עקיפה לעבודה מהטופס.

Decoder
Frame-accurate, ללא re-encode
Diarization
פיצול ערוץ אם סטריאו, אחרת אקוסטי
מודל דובר
Auto · 1-12 דוברים
שפה
Auto-detect מ-30 s הראשונה
מילות מילוי
הוסרו (toggle כדי לשמור)
חבילת ייצוא
DOCX + SRT + TXT עם חותמות זמן

Accuracy · real-world numbers

95%+ על 192 kbps סטריאו. שימושי עד 64 kbps mono.

דיוק MP3 מוגבל על ידי מה האנקודר שמר, לא על ידינו. דחיסה תפיסה מעל ~96 kbps שומרת על הבנת דיבור טוב מאוד; תחת 64 kbps, עיצורים וקונסוננטים מתחילים להתמוסס. המספרים להלן הם מ-MP3s בעלי ספק אמיתי בייצור.

96%
320 kbps סטריאו, מקור סטודיו

כמעט ללא הפסד לדיבור. משדרי podcast, יצואי אפליקציית הכתבה, ריגים מקצועיים של ראיון. Diarization נקי אם דוברים בערוצים נפרדים.

95%
192 kbps סטריאו, 2-3 דוברים

ביטריט הנפוץ ביותר עבור MP3s שמדברים. יצואי Zoom, הורדות Riverside, ברירות הדפס מקורי של מקליט. חפצי דחיסה בלתי מורגשים למזהה.

91%
128 kbps mono, שיחה

ברירות ברירת הדברים של פתק קול בטלפונים רובים. Diarization אקוסטי מטפל 2-4 דוברים. מספרים ושמות עצם מתאימים לפעמים צריכים הסתכלות.

84%
64 kbps mono, ארכיוני / טלפון-dump

שפות ישנות של מכונת תשובה, ארכיוני הרצאה, מקורות band-narrow. עיצורים בתדר גבוה (f/s/sh) מטושטשים. עדיין קריא — תכננו בדיקת הוכחה.

שאלות נפוצות

8 דברים שאנשים שואלים על דירוג MP3.

01מה הביטריט MP3 המינימלי שעדיין נותן תמליל שימושי?+
64 kbps הוא הרצפה המעשית. מתחת לכך, sibilants (s, sh, f) דחוסים לרעש ושיעור שגיאת מילה מטפס עבר 20%. אם אתה הקלטה טרייה, יעד 128 kbps mono או 192 kbps סטריאו — כל דבר גבוה יותר הוא overkill לדיבור.
02האם אני צריך להמיר את ה-MP3 שלי ל-WAV קודם לכן?+
כן. Re-encoding MP3 → WAV מוסיף עדות של דיוק כי הנתונים שהמקודד בחר לא הם חיברו עבור תמיד. העלה את ה-MP3 ישירות. אנחנו מפענחים מסגרות בזיכרון ומוזנים PCM להכיר.
03האם סטריאו MP3 ייתן לי תוויות דובר טובות יותר מ-mono?+
רק אם הדוברים היו בפועל הוקלטו בערוצים נפרדים — רוב סטריאו MP3s יש את אותו אודיו משני הצדדים ('dual mono') וקבלה כום דבר. True channel-split (כלומר יצואי Riverside, שני-מיקרופון שדה rigging) מאפשר לנו לדלג על diarization אקוסטי ותוויות דובר כמעט נכונה.
04מה גודל קובץ ה-MP3 המרבי שאתה מקבל?+
5 GB לכל העלאה, שהוא בערך 60 שעות ב-192 kbps או 90 שעות ב-128 kbps. אם הקובץ שלך גדול יותר נראה כשחק chunked upload — אין צורך לפצל את הקובץ בעצמך.
05כמה זמן לוקח הדירוג של ה-MP3 של 60 דקות?+
בדרך כלל 90 שניות מהעלאה-complete להיא-ready, קביעות של bitrate. פענוח מסגרות MP3 מהיר; הזמן הוא בהכנסן. Diarization מוסיף 5-10 שניות על קבצים מולטי-דובר.
06ה-MP3 שלי יש מוסיקה רקע — האם התמליל יהיה הרוס?+
מיטה מוסיקה שקטה תחת דיבור בסדר. מוסיקה חזקה שמתחרה עם הקול (מבוא stings, scoring תחת ראיונות) לפעמים עלויות misrecognitions על הברות חופפות. בדור דיכוי מוסיקה בטופס עבודה עם-סינון.
07אתה יכול להתמודד עם MP3s ממוז מ-voicemail טלפון או מכונות תשובה?+
כן, למרות שאלה בדרך כלל 8 kHz narrow-band re-encoded כ-MP3 — תקרת איכות האודיו קבוע על ידי הקלטת PSTN המקורית, לא ה-MP3 wrapper. צפוי 78-85% דיוק על סוג זה של מקור, שהוא אותו דבר שנקבל על השיחה הבסיסית.
08האם אתה שומר את ה-MP3 שלי לאחר שהתמליל בוצע?+
קבצים מחוקים אחרי 30 ימים כברירת דפס, או מיד בהתאם לבקשה דרך לוח הבקרה. התמליל נשאר בחשבונך עד שתחק אותו. אנחנו לא משתמשים באודיו של לקוח לאימון מודל — לעולם.

זרוק את ה-MP3 שלך. קבל טקסט בחזרה ב-90 שניות.

30 דקות חינם כל חודש. לא נדרש כרטיס. זיהוי דובר, 99 שפות, כל פורמט ייצוא כלול.

התחל חינם