انتقل إلى المحتوى
ai101.tools
للتنقلللفتحescللإغلاق
Claude+372Whisper+228LangChain+168Codex+223NotebookLM+276DALL-E 3+192DeepL+249n8n+208Topaz Video AI+153LlamaIndex+161
vLLM logo

vLLM

محرك استدلال عالي الإنتاجية للنماذج اللغوية

+164
حفظزيارة الموقع ↗
vLLM — لقطة شاشة للموقع

تعالج vLLM اختناق الموارد الحاسوبية عند نشر النماذج اللغوية الكبيرة على نطاق واسع. تتطلب النماذج الحديثة ذاكرة وقدرات حوسبة كبيرة، ما يجعل الاستدلال العملي مكلفًا وبطيئًا. تتيح آلية الانتباه المحسّنة والتجميع الديناميكي في vLLM تشغيل النماذج بسرعة أكبر وبتكلفة أقل مقارنة بالأساليب التقليدية.

أبرز الميزات

  • تعمل تقنية PagedAttention على افتراضية ذاكرة التخزين المؤقت لأزواج المفاتيح والقيم في آلية الانتباه لتقليل استهلاك ذاكرة GPU
  • يزيد التجميع المستمر وجدولة الطلبات من استغلال GPU والإنتاجية
  • يدعم أكثر من 200 بنية نموذج، بما فيها النماذج متعددة الوسائط ونماذج مزيج الخبراء
  • تكامل سلس مع Hugging Face بأقل قدر من التعديلات البرمجية
  • متوافق مع وحدات GPU من NVIDIA وAMD، ومعالجات Intel والمنصات العتادية الناشئة
  • يتضمن REST API متوافقًا مع OpenAI لتسهيل النشر

سواء كنت باحثًا ينشئ نماذج أولية، أو مهندس تعلم آلي ينشر أحمال الاستدلال في بيئة إنتاجية، أو مؤسسة تسعى إلى خفض التكاليف، توفر vLLM المرونة والأداء معًا. المشروع مفتوح المصدر بالكامل ومجاني الاستخدام، ما يجعل الاستدلال بمستوى المؤسسات متاحًا للفرق بجميع أحجامها.

التعليقات(0)

سجّل الدخول للتعليق

لا توجد تعليقات بعد، كن أول من يعلّق.

أدوات مشابهة

عرض البدائل →

الإبلاغ عن هذا التعليق

لماذا تُبلغ عن هذا؟