الوصف
نموذج Pixtral-12B-2409 هو نموذج ذكاء اصطناعي متعدد الوسائط متطور تم تطويره بواسطة Mistral AI، ومُستضاف على Hugging Face. يحتوي على 12 مليار معلمة في مُفكك الشيفرات متعدد الوسائط و400 مليون معلمة إضافية في مُشفّر الرؤية الخاص به. تم تصميم هذا النموذج للتعامل مع بيانات الصور والنصوص المتداخلة، مما يجعله متعدد الوسائط بشكل أصلي. يدعم أحجام الصور المتغيرة ويحافظ على أداء متقدم في المعايير الخاصة بالنصوص فقط.
يتفوق نموذج Pixtral-12B-2409 في مجموعة متنوعة من المهام متعددة الوسائط، كما يتضح من أدائه الرائد في فئته الوزنية. يحقق درجات عالية في المعايير مثل MMMU وMathvista وChartQA وDocVQA، مما يُظهر قدرته على التعامل مع الاستفسارات المعقدة وتفسير البيانات. كما أن النموذج يؤدي بشكل جيد في مهام اتباع التعليمات، مما يُظهر مرونته في سيناريوهات متنوعة.
النموذج مرخص بموجب Apache 2.0، مما يضمن الوصول المفتوح والمرونة للمطورين. يُوصى باستخدام Pixtral مع مكتبة vLLM لخطوط الاستدلال الجاهزة للإنتاج. يمكن دمج النموذج في إعدادات الخادم/العميل، مما يسمح بخيارات نشر متعددة.
على الرغم من قدراته المتقدمة، يفتقر نموذج Pixtral-12B-2409 إلى آليات الاعتدال، مما قد يحد من نشره في البيئات التي تتطلب مخرجات معتدلة. يعمل فريق Mistral AI بنشاط مع المجتمع لمعالجة هذه القيود وتحسين حواجز الأمان للنموذج.
أبرز ملامح نموذج Pixtral-12B-2409
مفكك شيفرات متعدد الوسائط بـ 12 مليار معلمة
مشفّر رؤية بـ 400 مليون معلمة
يدعم أحجام الصور المتغيرة
أداء متقدم في معايير النصوص
أداء رائد في المهام متعددة الوسائط
ترخيص Apache 2.0
تكامل موصى به مع vLLM
خيارات نشر للخادم/العميل
البدء مع نموذج Pixtral-12B-2409
الوصول إلى الصفحة: زيارة صفحة نموذج Hugging Face
تحميل النموذج: تنزيل Pixtral-12B-2409
تكوين البيئة: إعداد مكتبة vLLM
التكامل: الاستخدام في إعدادات الخادم/العميل
التعديل الدقيق: ضبط معلمات النموذج
حالات استخدام نموذج Pixtral-12B-2409
- معالجة الصور
- تحليل النصوص
- المهام متعددة الوسائط
- اتباع التعليمات
- نشر الخادم






