Whisper
نموذج OpenAI متعدد اللغات للتعرف على الكلام وترجمته

Whisper هو نموذج OpenAI عام الاستخدام للتعرف على الكلام، وقد دُرّب على 680 ألف ساعة من البيانات الصوتية المتنوعة ومتعددة اللغات. يتميز بالتعامل مع ضوضاء الخلفية والمصطلحات التقنية واللهجات المختلفة، وهي تحديات تتعثر فيها أنظمة التعرف التقليدية على الكلام غالبًا.
أبرز الميزات
- نسخ الصوت في 99 لغة وترجمة الكلام بغير الإنجليزية إلى الإنجليزية
- ستة إصدارات، من tiny ذي 39 مليون مُعلَمة إلى turbo ذي 1.5 مليار، لتحقيق توازنات مختلفة بين السرعة والدقة
- مقاومة جيدة للضوضاء وموسيقى الخلفية والمصطلحات التقنية
- مرخّص بموجب MIT، ومجاني بالكامل للاستخدام المحلي أو التجاري
- واجهة Python وأداة سطر أوامر بسيطتان، مع دعم MP3 وWAV وFLAC وصيغ أخرى
سواء كنت تبني خدمة لنسخ البودكاست، أو تنشئ أدوات لتسهيل الوصول، أو تعالج محتوى متعدد اللغات، يوفر Whisper دقة بمستوى المؤسسات دون رسوم ترخيص. وهو مفيد خصوصًا للتطبيقات التي تحتاج إلى نسخ موثوق عبر لغات وظروف صوتية متنوعة. يمكن تنزيله وتشغيله مجانًا على أجهزتك الخاصة.
أدوات مشابهة
عرض البدائل →Whisper Memos
مدفوعحوّل المذكرات الصوتية إلى رسائل بريد منسقة بالذكاء الاصطناعي
Whisper API
مجاني بميزات مدفوعةتحويل الكلام إلى نص عبر Whisper Large V3 مع تمييز المتحدثين
Aiko
مدفوعتحويل الكلام إلى نص محليًا على أجهزة Apple بالذكاء الاصطناعي
التعليقات(0)
سجّل الدخول للتعليق