انتقل إلى المحتوى
ai101.tools
للتنقلللفتحescللإغلاق
Claude+372Whisper+228LangChain+168Codex+223NotebookLM+276DALL-E 3+192DeepL+249n8n+208Topaz Video AI+153LlamaIndex+161
Whisper logo

Whisper

نموذج OpenAI متعدد اللغات للتعرف على الكلام وترجمته

+228
حفظزيارة الموقع ↗
Whisper — لقطة شاشة للموقع

Whisper هو نموذج OpenAI عام الاستخدام للتعرف على الكلام، وقد دُرّب على 680 ألف ساعة من البيانات الصوتية المتنوعة ومتعددة اللغات. يتميز بالتعامل مع ضوضاء الخلفية والمصطلحات التقنية واللهجات المختلفة، وهي تحديات تتعثر فيها أنظمة التعرف التقليدية على الكلام غالبًا.

أبرز الميزات

  • نسخ الصوت في 99 لغة وترجمة الكلام بغير الإنجليزية إلى الإنجليزية
  • ستة إصدارات، من tiny ذي 39 مليون مُعلَمة إلى turbo ذي 1.5 مليار، لتحقيق توازنات مختلفة بين السرعة والدقة
  • مقاومة جيدة للضوضاء وموسيقى الخلفية والمصطلحات التقنية
  • مرخّص بموجب MIT، ومجاني بالكامل للاستخدام المحلي أو التجاري
  • واجهة Python وأداة سطر أوامر بسيطتان، مع دعم MP3 وWAV وFLAC وصيغ أخرى

سواء كنت تبني خدمة لنسخ البودكاست، أو تنشئ أدوات لتسهيل الوصول، أو تعالج محتوى متعدد اللغات، يوفر Whisper دقة بمستوى المؤسسات دون رسوم ترخيص. وهو مفيد خصوصًا للتطبيقات التي تحتاج إلى نسخ موثوق عبر لغات وظروف صوتية متنوعة. يمكن تنزيله وتشغيله مجانًا على أجهزتك الخاصة.

التعليقات(0)

سجّل الدخول للتعليق

لا توجد تعليقات بعد، كن أول من يعلّق.

أدوات مشابهة

عرض البدائل →

الإبلاغ عن هذا التعليق

لماذا تُبلغ عن هذا؟