تخطَّ إلى المحتوى الرئيسي
ToolPotion

intfloat multilingual-e5-large

نموذج intfloat multilingual-e5-large هو أداة ذكاء اصطناعي قوية مصممة لتضمين النصوص متعددة اللغات. يدعم 100 لغة ومُحسّن لمهام مثل استرجاع النصوص والتشابه الدلالي، مما يوفر أداءً عاليًا عبر مجموعات بيانات متنوعة.

عرض النموذج
مشاركة

الوصف

نموذج intfloat multilingual-e5-large هو أداة ذكاء اصطناعي متطورة تم تطويرها لتوفير تضمين النصوص متعددة اللغات. يعتمد على إطار عمل xlm-roberta-large وقد تم تدريبه بشكل إضافي على مزيج من مجموعات البيانات متعددة اللغات. يدعم هذا النموذج 100 لغة، على الرغم من أن الأداء قد يختلف بالنسبة للغات ذات الموارد المنخفضة. يتميز بـ 24 طبقة مع حجم تضمين يبلغ 1024، مما يجعله مناسبًا لمهام معالجة النصوص المعقدة.

يمر النموذج بعملية تدريب من مرحلتين. تتضمن المرحلة الأولى التدريب المسبق التبايني مع إشراف ضعيف عبر مجموعات بيانات متنوعة، بما في ذلك mC4 وCC News وWikipedia وغيرها، بإجمالي مليارات من أزواج النصوص. المرحلة الثانية هي التخصيص الخاضع للإشراف باستخدام مجموعات بيانات مثل MS MARCO وNQ وSQuAD، مع التركيز على اللغة الإنجليزية ولغات أخرى.

تظهر نتائج المعايير أن نموذج multilingual-e5-large يحقق متوسط MRR@10 يبلغ 70.5، متفوقًا على النماذج الأصغر في لغات متنوعة. إنه فعال بشكل خاص في مهام مثل استرجاع المقاطع والتشابه الدلالي، حيث يستخدم بادئات محددة مثل 'query:' و'passage:' للحفاظ على الأداء.

النموذج متكامل مع sentence_transformers، ويتطلب إصدارات محددة من الحزم لتحقيق الأداء الأمثل. تم تصميمه للتعامل مع تضمين النصوص بكفاءة، على الرغم من أنه يقوم بتقصير النصوص الطويلة إلى 512 رمزًا. أداء النموذج قوي عبر معايير مختلفة، مما يجعله أداة قيمة للباحثين والمطورين الذين يعملون مع بيانات النصوص متعددة اللغات.

أبرز ملامح intfloat multilingual-e5-large

  • يدعم 100 لغة

  • 24 طبقة بحجم تضمين 1024

  • مستند من xlm-roberta-large

  • تدريب مسبق تبايني مع إشراف ضعيف

  • تخصيص خاضع للإشراف على مجموعات بيانات متنوعة

  • أداء عالي في المعايير متعددة اللغات

  • تكامل مع sentence_transformers

  • يتعامل مع تضمين النصوص حتى 512 رمزًا

البدء مع intfloat multilingual-e5-large

  1. الوصول إلى الصفحة: زيارة صفحة نموذج Hugging Face

  2. تحميل النموذج: تنزيل وتهيئة النموذج

  3. تهيئة البيئة: إعداد الحزم المطلوبة

  4. التكامل: استخدامه مع sentence_transformers

  5. التخصيص: تطبيق مجموعات بيانات خاضعة للإشراف لمهام محددة

حالات استخدام intfloat multilingual-e5-large

  • تضمين النصوص متعددة اللغات
  • التشابه الدلالي
  • استرجاع المقاطع
  • تصنيف النصوص
  • استرجاع المعلومات

الأسئلة الشائعة من intfloat multilingual-e5-large

تقييمات intfloat multilingual-e5-large

جاري التحميل...

أدوات ذكاء اصطناعي شائعة مثل intfloat multilingual-e5-large

نماذج الذكاء الاصطناعي

nomic-embed-text-v2-moe هو نموذج متقدم لتضمين النصوص متعدد اللغات يعتمد على مزيج من الخبراء. يدعم حوالي 100 لغة ويتفوق في مهام الاسترجاع متعددة اللغات، مما يوفر أبعاد تضمين مرنة…

نماذج الذكاء الاصطناعي ونماذج اللغة الكبيرة

نماذج الذكاء الاصطناعي

XLM-RoBERTa هو نموذج متعدد اللغات تم تدريبه مسبقًا على 2.5 تيرابايت من البيانات عبر 100 لغة. يتفوق في مهام مثل تصنيف التسلسل وتصنيف الرموز، مما يجعله أداة قيمة لمجموعة متنوعة من…

مميزةنماذج الذكاء الاصطناعي ونماذج اللغة الكبيرة

نماذج الذكاء الاصطناعي

Mistral Large 3 هو نموذج ذكاء اصطناعي متطور مصمم للمؤسسات، مما يتيح التخصيص، والتدريب الدقيق، ونشر المساعدين والوكلاء الذكيين. يتميز بهندسة مختلطة نادرة من الخبراء مع 41 مليار…

مميزةنماذج الذكاء الاصطناعي ونماذج اللغة الكبيرة

DeepSeek-V3 هو نموذج لغوي من نوع Mixture-of-Experts يحتوي على 671 مليار معلمة، مصمم لتحقيق استدلال فعال وتدريب اقتصادي. يتفوق في مختلف المعايير، مما يظهر أداءً قويًا في مهام…

مميزةنماذج الذكاء الاصطناعي ونماذج اللغة الكبيرة

نماذج الذكاء الاصطناعي

Wav2Vec2 Large XLSR-53 هو نموذج صوتي مدرب مسبقًا مصمم للتعرف على الكلام عبر اللغات. يتطلب ضبطًا دقيقًا لمهام محددة مثل التعرف التلقائي على الكلام، مما يوفر معدلات خطأ محسنة عبر…

نماذج الذكاء الاصطناعي ونماذج اللغة الكبيرة

نماذج الذكاء الاصطناعي

نموذج SmolLM3 هو نموذج لغة يحتوي على 3 مليار معلمة مصمم لدفع حدود النماذج الصغيرة. يدعم التفكير في وضعين، وست لغات، ومعالجة سياق طويل، مما يوفر أداءً قويًا في نطاق 3B–4B.

نماذج الذكاء الاصطناعي ونماذج اللغة الكبيرة

نماذج الذكاء الاصطناعي

Llama-4 Maverick 17B-128E Instruct هو نموذج ذكاء اصطناعي متعدد الوسائط تم تطويره بواسطة ميتا، مصمم لفهم النصوص والصور بشكل متقدم. يستفيد من بنية مزيج من الخبراء لتقديم أداء عالٍ…

نماذج الذكاء الاصطناعي ونماذج اللغة الكبيرة

نماذج الذكاء الاصطناعي

تقدم نماذج Intern الكبيرة (InternLM)، التي طورتها مختبر شنغهاي للذكاء الاصطناعي، نماذج لغوية كبيرة (LLMs) ونماذج لغوية متعددة الوسائط (MLLMs) مفتوحة المصدر. تشمل مجموعتها نماذج…

نماذج الذكاء الاصطناعي ونماذج اللغة الكبيرة