تخطَّ إلى المحتوى الرئيسي
ToolPotion

MiMo-V2.5-Pro

MiMo-V2.5-Pro هو نموذج لغة متقدم مفتوح المصدر من نوع Mixture-of-Experts مصمم للمهام المعقدة. يتميز بهندسة انتباه هجينة ويدعم طول سياق يصل إلى 1 مليون توكن، مما يجعله مثالياً لمهام هندسة البرمجيات المت demanding والمهام طويلة الأمد.

عرض النموذج
مشاركة

الوصف

MiMo-V2.5-Pro هو نموذج لغة متقدم مفتوح المصدر من نوع Mixture-of-Experts (MoE) يحتوي على إجمالي 1.02 تريليون معلمة و42 مليار معلمة نشطة. تم تصميمه للتعامل مع أكثر المهام المعقدة والمت demanding في هندسة البرمجيات والمهام طويلة الأمد. يستخدم النموذج هندسة انتباه هجينة، حيث يدمج بين Sliding Window Attention (SWA) وGlobal Attention (GA) بنسبة 6:1، مما يقلل بشكل كبير من تخزين KV-cache مع الحفاظ على أداء السياق الطويل. تكمل هذه الهندسة ثلاثة وحدات خفيفة الوزن للتنبؤ متعدد التوكنات (MTP) التي تعزز سرعة الإخراج أثناء الاستدلال.

تم تدريب النموذج مسبقاً على 27 تريليون توكن باستخدام دقة مختلطة FP8 ويدعم نافذة سياق تصل إلى 1 مليون توكن. بعد التدريب، يستخدم MiMo-V2.5-Pro تقنية Fine-Tuning تحت إشراف (SFT) وتعلم تعزيز وكيل واسع النطاق (RL) وتقنية Multi-Teacher On-Policy Distillation (MOPD) لتحقيق أداء متفوق في المهام المعقدة. يتفوق في الحفاظ على مسارات معقدة عبر نافذة سياق مكونة من 1 مليون توكن، مما يجعله فعالاً للغاية في المهام التي تتطلب اتباع التعليمات بشكل قوي والتماسك.

تعالج هندسة MiMo-V2.5-Pro التعقيد التربيعي للسياقات الطويلة من خلال دمج Local Sliding Window Attention وGlobal Attention. تشمل عملية تدريبه نموذجاً ثلاثي المراحل بعد التدريب يبدأ بـ SFT لبناء المهارات الأساسية، يليه تدريب متخصص في المجال مع نماذج معلم متنوعة، وينتهي بـ MOPD لتعلم تعزيز ديناميكي على السياسة.

يدعم نشر النموذج مجتمعات SGLang وvLLM، مع تكوينات موصى بها لتحقيق الأداء الأمثل. MiMo-V2.5-Pro مثالي للصناعات التي تتطلب قدرات متقدمة في معالجة اللغة، مثل هندسة البرمجيات والتطبيقات متعددة اللغات.

أبرز ملامح MiMo-V2.5-Pro

  • 1.02 تريليون معلمة إجمالية

  • 42 مليار معلمة نشطة

  • هندسة انتباه هجينة

  • تنبؤ متعدد التوكنات (MTP)

  • تدريب مسبق فعال على 27 تريليون توكن

  • طول سياق 1 مليون توكن

  • Fine-Tuning تحت إشراف (SFT)

  • Multi-Teacher On-Policy Distillation (MOPD)

  • Sliding Window Attention (SWA)

  • Global Attention (GA)

البدء مع MiMo-V2.5-Pro

  1. الوصول إلى الصفحة: زيارة صفحة نموذج Hugging Face

  2. تحميل النموذج: تنزيل MiMo-V2.5-Pro

  3. تكوين البيئة: إعداد مع المعلمات الموصى بها

  4. التكامل: تنفيذ في تطبيقك

  5. التعديل: ضبط النموذج لمهام محددة

حالات استخدام MiMo-V2.5-Pro

  • هندسة البرمجيات المعقدة
  • المهام الوكيلة
  • التطبيقات متعددة اللغات
  • التفكير في السياقات الطويلة
  • تعلم التعزيز

الأسئلة الشائعة من MiMo-V2.5-Pro

From Xiaomi

a model in MiMo.

تقييمات MiMo-V2.5-Pro

جاري التحميل...

أدوات ذكاء اصطناعي شائعة مثل MiMo-V2.5-Pro

DeepSeek-V3 هو نموذج لغوي من نوع Mixture-of-Experts يحتوي على 671 مليار معلمة، مصمم لتحقيق استدلال فعال وتدريب اقتصادي. يتفوق في مختلف المعايير، مما يظهر أداءً قويًا في مهام…

مميزةنماذج الذكاء الاصطناعي ونماذج اللغة الكبيرة

DeepSeek-V4-Pro هو نموذج متقدم للذكاء الاصطناعي مصمم لتحقيق كفاءة في ذكاء السياق الذي يتضمن مليون رمز. يتميز بهندسة انتباه هجينة وتم تدريبه مسبقًا على أكثر من 32 تريليون رمز، مما…

مميزةنماذج الذكاء الاصطناعي ونماذج اللغة الكبيرة

نماذج الذكاء الاصطناعي

Kimi K3 هو نموذج ذكاء اصطناعي متقدم متعدد الأنماط مفتوح الوزن مصمم للبرمجة على المدى الطويل، وأعمال المعرفة، والتفكير. يتميز بنافذة سياق تتسع لمليون رمز، ويعتمد على هياكل مبتكرة…

مميزةنماذج الذكاء الاصطناعي ونماذج اللغة الكبيرة

نماذج الذكاء الاصطناعي

نموذج MiMo-V2.5 هو نموذج رائد للذكاء الاصطناعي من شاومي، يقدم قدرات بمليارات المعلمات لزيادة الإنتاجية في العالم الحقيقي. يتفوق في المهام طويلة الأمد ويدعم حتى 1 مليون توكن في…

نماذج الذكاء الاصطناعي ونماذج اللغة الكبيرة

نماذج الذكاء الاصطناعي

نموذج كيمي-K2-تعليم هو نموذج لغوي متقدم يعتمد على مزيج من الخبراء مصمم لمهام الذكاء الاصطناعي المتقدمة. يتفوق في التفكير، والترميز، واستخدام الأدوات، ويقدم أداءً قويًا مع 32 مليار…

نماذج الذكاء الاصطناعي ونماذج اللغة الكبيرة

نموذج NVIDIA Nemotron 3 Ultra هو نموذج ذكاء اصطناعي قوي مصمم للمهام المعقدة متعددة اللغات. مع 550 مليار معلمة، يتفوق في تحليل السياقات الطويلة واستخدام الأدوات، مما يجعله مثالياً…

مميزةنماذج الذكاء الاصطناعي ونماذج اللغة الكبيرة

نماذج الذكاء الاصطناعي

Longformer Base 4096 هو نموذج محول مصمم لمعالجة المستندات الطويلة. يبني على RoBERTa، مدرب مسبقًا على تسلسلات موسعة تصل إلى 4096 رمزًا. يستخدم هذا النموذج آلية انتباه هجينة، تجمع…

نماذج الذكاء الاصطناعي ونماذج اللغة الكبيرة

نماذج الذكاء الاصطناعي

يقدم DeepSeek-v3 حلول ذكاء اصطناعي فورية مدعومة ببنية MoE المتقدمة ونماذج لغوية حديثة. استمتع بقدرات ذكاء اصطناعي متطورة مع هذا النموذج المستقر والمجاني وغير المحدود، المصمم…

نماذج الذكاء الاصطناعي ونماذج اللغة الكبيرة