تخطَّ إلى المحتوى الرئيسي
ToolPotion

نموذج فلورنس-2

فلورنس-2 هو نموذج متقدم للرؤية من مايكروسوفت، مصمم للتعامل مع مجموعة متنوعة من مهام الرؤية والرؤية-اللغة. يستخدم نهجًا قائمًا على المطالبات لمهام مثل التسمية واكتشاف الكائنات، مستفيدًا من مجموعة بيانات ضخمة للتعلم متعدد المهام.

عرض النموذج
مشاركة

الوصف

فلورنس-2 هو نموذج متقدم للرؤية تم تطويره بواسطة مايكروسوفت، مستضاف على هاغينغ فيس. تم تصميمه لتعزيز تمثيل موحد لمجموعة متنوعة من مهام الرؤية. يستخدم النموذج نهجًا قائمًا على المطالبات للتعامل بكفاءة مع مجموعة واسعة من مهام الرؤية والرؤية-اللغة، مثل التسمية، واكتشاف الكائنات، والتجزئة. يستفيد فلورنس-2 من مجموعة بيانات FLD-5B، التي تحتوي على 5.4 مليار تعليق عبر 126 مليون صورة، للتفوق في التعلم متعدد المهام.

معمارية النموذج هي من نوع تسلسل إلى تسلسل، مما يمكّنه من الأداء الجيد في كل من الإعدادات بدون تدريب مسبق والإعدادات المعدلة. إنه نموذج متقدم للرؤية، قادر على تفسير المطالبات النصية البسيطة لتنفيذ مهام متنوعة. تم تدريب فلورنس-2 مسبقًا بطول سياق 4k، باستخدام 0.1 مليار عينة فقط للتدريب المستمر، مما قد يؤثر على جودة تدريبه.

تشمل قدرات فلورنس-2 التعامل مع مهام مثل ربط التسمية بالعبارات، واكتشاف الكائنات، والتسمية في المناطق الكثيفة، والتعرف الضوئي على الحروف مع مخرجات المناطق. أداء النموذج في الإعدادات بدون تدريب مسبق ملحوظ، مع درجات CIDEr عالية على مجموعات بيانات COCO وNoCaps. بالإضافة إلى ذلك، تم تعديل فلورنس-2 على مجموعة من المهام اللاحقة، مما أدى إلى نماذج مثل فلورنس-2-base-ft وفلورنس-2-large-ft، التي تؤدي بشكل جيد عبر مهام التسمية المختلفة وVQA.

النموذج متاح بأحجام مختلفة، بما في ذلك فلورنس-2-base مع 0.23 مليار معلمة وفلورنس-2-large مع 0.77 مليار معلمة. تتوفر موارد مثل التقارير الفنية ودفاتر Jupyter للمستخدمين للبدء في استخدام النموذج. فلورنس-2 هو أداة قيمة للباحثين والمطورين الذين يعملون على مهام الرؤية والرؤية-اللغة، حيث يوفر أساسًا قويًا لمزيد من التطوير والتطبيق.

أبرز ملامح نموذج فلورنس-2

  • نموذج متقدم للرؤية

  • نهج قائم على المطالبات

  • يتعامل مع مهام الرؤية-اللغة

  • معمارية تسلسل إلى تسلسل

  • إعدادات بدون تدريب مسبق ومعدلة

  • يستخدم مجموعة بيانات FLD-5B

  • يدعم التسمية واكتشاف الكائنات

  • التعرف الضوئي على الحروف مع مخرجات المناطق

البدء مع نموذج فلورنس-2

  1. الوصول إلى الصفحة: زيارة صفحة نموذج هاغينغ فيس

  2. تحميل النموذج: تنزيل نموذج فلورنس-2

  3. تكوين البيئة: إعداد الاعتماديات اللازمة

  4. التكامل: استخدام النموذج في التطبيقات

  5. التعديل: ضبط النموذج لمهام محددة

حالات استخدام نموذج فلورنس-2

  • تسمية الصور
  • اكتشاف الكائنات
  • مهام الرؤية-اللغة
  • التعرف الضوئي على الحروف مع المنطقة
  • تسمية المناطق الكثيفة

الأسئلة الشائعة من نموذج فلورنس-2

أدوات ذكاء اصطناعي شائعة مثل نموذج فلورنس-2

نماذج الذكاء الاصطناعي

Llama-3.2-11B-Vision-Instruct هو نموذج ذكاء اصطناعي متعدد الوسائط مصمم للتعرف البصري، واستنتاج الصور، والتعليق. تم تطويره بواسطة ميتا، ويجمع بين مدخلات النص والصورة لتقديم قدرات…

نماذج الذكاء الاصطناعي ونماذج اللغة الكبيرة

نماذج الذكاء الاصطناعي

فلامنجو هو نموذج لغة مرئي (VLM) واحد من Google DeepMind يتفوق في التعلم بالقليل من الأمثلة عبر مهام متعددة الوسائط متنوعة. يقوم بمعالجة الصور ومقاطع الفيديو والنصوص المتداخلة…

نماذج الذكاء الاصطناعي ونماذج اللغة الكبيرة

Phi-4-reasoning-vision-15B هو نموذج ذكاء اصطناعي متعدد الوسائط تم تطويره بواسطة مايكروسوفت، مصمم للمهام التي تتطلب فهم اللغة البصرية وقدرات التفكير. يتفوق في التفكير العلمي ومهام…

مميزةنماذج الذكاء الاصطناعي ونماذج اللغة الكبيرة

نماذج الذكاء الاصطناعي

Qwen3 VL 8B Instruct من Alibaba هو نموذج قوي للرؤية واللغة يقدم فهمًا متفوقًا للنصوص، وإدراكًا بصريًا، واستدلالًا متعدد الوسائط. يدعم نشرًا مرنًا مع هياكل Dense وMoE، مما يعزز…

نماذج الذكاء الاصطناعي ونماذج اللغة الكبيرة

نماذج الذكاء الاصطناعي

Oscar و VinVL هما نموذجان متقدمان للذكاء الاصطناعي لمهام الرؤية واللغة. يستخدم Oscar محاذاة الدلالات الكائنية للتدريب المسبق، محققًا أحدث النتائج. يعزز VinVL التمثيلات المرئية،…

نماذج الذكاء الاصطناعي ونماذج اللغة الكبيرة

نماذج الذكاء الاصطناعي

LLaVA هو نموذج متعدد الوسائط كبير يجمع بين مشفر الرؤية ونموذج لغوي للفهم البصري واللغوي للأغراض العامة. يتفوق في قدرات الدردشة متعددة الوسائط، محاكياً GPT-4، ويحقق دقة متطورة في…

نماذج الذكاء الاصطناعي ونماذج اللغة الكبيرة

نماذج الذكاء الاصطناعي

Mistral-7B-v0.1 هو نموذج نصي توليدي مدرب مسبقًا يحتوي على 7 مليارات معلمة، مصمم لتعزيز الذكاء الاصطناعي من خلال المصادر المفتوحة. يتفوق على Llama 2 13B في مختلف المعايير، مما…

مميزةنماذج الذكاء الاصطناعي ونماذج اللغة الكبيرة

نماذج الذكاء الاصطناعي

MiniGPT-4 هو نموذج ذكاء اصطناعي يعزز فهم الرؤية واللغة من خلال مواءمة مشفر مرئي مجمد مع نموذج لغوي كبير. يمكنه إنشاء أوصاف تفصيلية للصور، وإنشاء مواقع ويب من مسودات، وكتابة قصص…

نماذج الذكاء الاصطناعي ونماذج اللغة الكبيرة