الوصف
نموذج Qwen3-0.6B هو أحدث إصدار في سلسلة Qwen، مصمم لدفع حدود نماذج اللغة الكبيرة. يقدم مجموعة شاملة من النماذج الكثيفة ومزيج من الخبراء (MoE)، مبنية على تدريب واسع لتقديم تقدمات رائدة في التفكير، واتباع التعليمات، وقدرات الوكلاء. يدعم النموذج التبديل السلس بين وضع التفكير، للتفكير المنطقي المعقد، والرياضيات، والترميز، ووضع غير التفكير، للحوار العام الفعال. يضمن ذلك أداءً مثاليًا عبر سيناريوهات متنوعة.
يعزز نموذج Qwen3-0.6B بشكل كبير قدراته في التفكير، متجاوزًا النماذج السابقة في الرياضيات، وتوليد الشفرات، والتفكير المنطقي السليم. يتماشى بشكل وثيق مع تفضيلات البشر، متفوقًا في الكتابة الإبداعية، ولعب الأدوار، والحوار متعدد الأدوار، واتباع التعليمات، لتقديم تجربة حوارية أكثر طبيعية وجاذبية وغامرة. تتيح خبرته في قدرات الوكلاء دمجًا دقيقًا مع الأدوات الخارجية، محققًا أداءً رائدًا بين النماذج مفتوحة المصدر في المهام المعقدة المعتمدة على الوكلاء.
يدعم النموذج أكثر من 100 لغة ولهجة، مع قدرات قوية في اتباع التعليمات متعددة اللغات والترجمة. إنه نموذج لغوي سببي يحتوي على 0.6 مليار معلمة، بما في ذلك 0.44 مليار معلمة غير تضمينية، و28 طبقة، و16 رأس انتباه لـ Q و8 لـ KV. طول السياق هو 32,768 توكن، مما يوفر مساحة كافية لتوليد استجابات مفصلة.
تم دمج نموذج Qwen3-0.6B في أحدث محولات Hugging Face، مع دعم للتطبيقات المحلية مثل Ollama وLMStudio وMLX-LM وllama.cpp وKTransformers. يقدم خيارات استخدام متقدمة، بما في ذلك التبديل بين أوضاع التفكير وغير التفكير عبر إدخال المستخدم، ويتفوق في قدرات استدعاء الأدوات مع Qwen-Agent. للحصول على أداء مثالي، يُوصى بإعداد معلمات أخذ العينات وأطوال المخرجات المحددة.
أبرز ملامح نموذج Qwen3-0.6B
نماذج كثيفة ونماذج مزيج من الخبراء
تبديل وضع سلس
تعزيز قدرات التفكير
محاذاة تفضيلات البشر
دمج الوكلاء
دعم متعدد اللغات
نموذج لغوي سببي
عدد معلمات واسع
البدء مع نموذج Qwen3-0.6B
الوصول إلى الصفحة: زيارة Hugging Face
تحميل النموذج: استخدام مكتبة المحولات
تكوين البيئة: تعيين المعلمات
الدمج: الاستخدام مع التطبيقات المحلية
التدريب الدقيق: التعديل للمهام المحددة
حالات استخدام نموذج Qwen3-0.6B
- الترجمة متعددة اللغات
- التفكير المعقد
- الكتابة الإبداعية
- دمج الوكلاء
- اتباع التعليمات










