Whisper محلي / مفتوح المصدر
مجاني إذا كان لديك GPU و ساعة من الوقت. بدون تحديد متحدثين من الصندوق.
أسقط ملف MP3 عند أي معدل نقل من 64 إلى 320 kbps. احصل على نص مع طوابع زمنية وتسميات متحدثين في 99 لغة — بدون تحويل صيغة، بدون إعادة ترميز، بدون انتظار في الطابور.
MP3 · WAV · M4A · MP4 · MOV · MKV · OGG · OPUS · FLAC · WEBM — up to 100 MB anonymously
YouTube · TikTok · Vimeo · Twitter · SoundCloud · Spotify · 50+ more
↓ شاهد النتيجة
نقرأ رؤوس إطارات MP3 مباشرة — VBR و CBR و joint-stereo و أي محرّر ترميز (LAME و Fraunhofer و FFmpeg). إذا كان الملف ستيريو حقيقي مع متحدثين على قنوات منفصلة، نستخدم ذلك لفصل الأصوات. الخليط أحادي يعود إلى تحديد المتحدثين الصوتي.
فمتى أدركت للمرة الأولى أن الأرشيف غير مكتمل؟
ربما حول عام 2019، عندما بدأنا رقمنة الملفات الشريطية.
والأشرطة المفقودة — هل تم فهرستها في أي مكان على الإطلاق؟
يوجد فهرس ورقي من سنة 78، لكن نصفه تضرر من الماء.
↓ This is the dashboard
Same layout as the real dashboard — Summary, full Transcript, Speakers tab, Exports. Key points and action items extracted automatically. Auto-tags on every job.
Sample preview from a founder interview about post-call workflow. Real transcripts look exactly like this — same tabs, same summary block, same key-points / action-items split, same auto-tag chips.
ثلاثة خيارات حقيقية · مقارنة صادقة
يمكنك تشغيل Whisper على جهاز الكمبيوتر المحمول الخاص بك مجاناً إذا كنت تقنياً. Otter و Sonix يقبلان رفع MP3 داخل لوحات التحكم. نحن نأخذ الملف، نُرجع النص، ولا نجعلك تعيش داخل واجهة مستخدم.
مجاني إذا كان لديك GPU و ساعة من الوقت. بدون تحديد متحدثين من الصندوق.
أسقط MP3. احصل على نص مع تسميات متحدثين بسرعة تقريباً حقيقية × 0.025.
لوحة تحكم مصقولة، حد أقصى لدقائق شهرية، مضبوط على الإنجليزية. رفع الملف يبدو كميزة جانبية.
التسعير وتوفر الميزات دقيقة اعتباراً من مايو 2026. أداء Whisper تختلف حسب حجم النموذج والأجهزة.
خاص بـ MP3
MP3 هي صيغة، وليست نمط تسجيل — مما يعني أن أنماط الفشل تأتي من المشفّر، وليس من الكلام.
الافتراضيات التي تناسب ~80% من ملفات MP3. تجاوز لكل وظيفة من النموذج.
Accuracy · real-world numbers
دقة MP3 محدودة بـ ما احتفظ به المشفّر، وليس بنا. الضغط الإدراكي فوق ~96 kbps يحافظ على وضوح الكلام بشكل جيد جداً؛ تحت 64 kbps، تبدأ الأصوات والحروف الساكنة في الاختفاء. الأرقام أدناه من ملفات MP3 حقيقية للعملاء في الإنتاج.
تقريباً بدون فقدان للكلام. رئيسيات بودكاست، تصديرات تطبيق الإملاء، أجهزة مقابلة احترافية. تحديد متحدثين نظيف إذا كان المتحدثون على قنوات منفصلة.
معدل النقل الأكثر شيوعاً لملفات MP3 المنطوقة. تصديرات Zoom، تنزيلات Riverside، أجهزة التسجيل الافتراضية. نوادي الضغط غير مسموعة للمعترف.
الافتراضيات الخاصة بمذكرة صوتية على معظم الهواتف. تحديد المتحدثين الصوتي يتعامل مع 2-4 متحدثين. الأرقام والأسماء العلمية تحتاج أحياناً إلى نظرة.
تمزقات آلة الرد القديمة، أرشيفات المحاضرات، مصادر ضيقة النطاق. الحروف السا��نة عالية التردد (f/s/sh) غير واضحة. لا يزال قابلاً للقراءة — خطط لمراجعة دقيقة.
أسئلة شائعة
30 دقيقة مجانية كل شهر. لا بطاقة المطلوبة. تسميات المتحدثين، 99 لغة، كل صيغة تصدير مضمنة.
ابدأ مجاناً