تخطَّ إلى المحتوى الرئيسي
ToolPotion

برمجيات دينامو-ترايتون مفتوحة المصدر

تمكن NVIDIA دينامو-ترايتون من نشر نماذج الذكاء الاصطناعي عبر أطر عمل متنوعة مثل TensorRT وPyTorch وONNX. يدعم أحمال العمل في الوقت الحقيقي، والأحمال المجمعة، والبث، مما يجعله مناسبًا لتطبيقات الذكاء الاصطناعي المتنوعة.

زيارة الرابط
مشاركة

الوصف

NVIDIA دينامو-ترايتون، المعروف سابقًا باسم خادم استدلال NVIDIA ترايتون، هو برنامج مفتوح المصدر مصمم لتسهيل نشر نماذج الذكاء الاصطناعي عبر الأطر الرئيسية مثل TensorRT وPyTorch وONNX وOpenVINO وPython وRAPIDS FIL. توفر هذه الأداة القوية أداءً عاليًا من خلال ميزات مثل التجميع الديناميكي، والتنفيذ المتزامن، والتكوينات المحسّنة. دينامو-ترايتون قادر على دعم مجموعة متنوعة من أحمال العمل، بما في ذلك أحمال العمل في الوقت الحقيقي، والأحمال المجمعة، والمجموعات، وبث الصوت/الفيديو، ويعمل بسلاسة على وحدات معالجة الرسوميات NVIDIA، والمعجلات غير التابعة لـ NVIDIA، ووحدات المعالجة المركزية x86 وARM.

كحل مفتوح المصدر، يتوافق دينامو-ترايتون مع كل من سير العمل DevOps وMLOps، ويتكامل بشكل فعال مع Kubernetes للتوسع وPrometheus للمراقبة. تم تصميمه للعمل عبر منصات الذكاء الاصطناعي السحابية والمحلية، مما يوفر بيئة آمنة وجاهزة للإنتاج كجزء من NVIDIA AI Enterprise. تشمل هذه البيئة واجهات برمجة التطبيقات المستقرة ودعمًا واسعًا لنشر الذكاء الاصطناعي، مما يضمن أن يتمكن المطورون من إدارة نماذج الذكاء الاصطناعي بكفاءة.

لتطبيقات نماذج اللغة الكبيرة (LLM)، تقدم NVIDIA أدوات إضافية مثل NVIDIA دينامو، المصممة لاستدلال LLM والنشر متعدد الأوضاع. تكمل هذه الأداة دينامو-ترايتون من خلال توفير تحسينات خاصة بـ LLM، بما في ذلك تقديم غير مجمع، وتخزين مؤقت للبادئات، وتخزين مؤقت للقيم الرئيسية. يمكن للمطورين الوصول إلى ثروة من الموارد، بما في ذلك الوثائق والدروس ومجموعات البداية، لمساعدتهم في البدء مع دينامو-ترايتون وتعظيم قدراته في مشاريعهم في الذكاء الاصطناعي.

الميزات الأساسية لـ برمجيات دينامو-ترايتون مفتوحة المصدر

  • مفتوح المصدر

  • يدعم TensorRT وPyTorch وONNX وOpenVINO

  • أحمال العمل في الوقت الحقيقي والمجمعة

  • التجميع الديناميكي

  • التنفيذ المتزامن

  • يتكامل مع Kubernetes

  • متوافق مع Prometheus

  • يعمل على أجهزة NVIDIA وغير NVIDIA

  • يدعم النشر السحابي والمحلي

  • تحسينات خاصة بـ LLM متاحة

البدء مع برمجيات دينامو-ترايتون مفتوحة المصدر

  1. تكوين: إعداد بيئتك لنشر نماذج الذكاء الاصطناعي.

  2. دمج: ربط دينامو-ترايتون مع أطر الذكاء الاصطناعي التي تختارها.

  3. نشر: إطلاق نماذج الذكاء الاصطناعي الخاصة بك باستخدام خادم استدلال ترايتون.

  4. مراقبة: استخدام Prometheus لتتبع الأداء واستخدام الموارد.

  5. توسيع: استخدام Kubernetes لتوسيع نشراتك حسب الحاجة.

حالات استخدام برمجيات دينامو-ترايتون مفتوحة المصدر

  • استدلال الذكاء الاصطناعي في الوقت الحقيقي
  • معالجة الدفعات
  • بث الصوت/الفيديو
  • نماذج اللغة الكبيرة
  • النشر السحابي

الأسئلة الشائعة من برمجيات دينامو-ترايتون مفتوحة المصدر

From NVIDIA

تقييمات برمجيات دينامو-ترايتون مفتوحة المصدر

جاري التحميل...

أدوات ذكاء اصطناعي شائعة مثل برمجيات دينامو-ترايتون مفتوحة المصدر

أطر عمل الذكاء الاصطناعي

LiteRT هو إطار عمل التعلم الآلي عالي الأداء من Google للنشر على الأجهزة، مخصص لنشر نماذج GenAI والتعلم الآلي على منصات الحافة. يوفر تحويلًا وتشغيلًا وتحسينًا فعالًا، بناءً على…

MLOps ونشر النماذج

أطر عمل الذكاء الاصطناعي

TensorFlow Extended (TFX) هي منصة تعلم آلي على نطاق الإنتاج من Google. توفر إطار عمل للتكوين ومكتبات مشتركة لدمج المكونات الشائعة لتعريف وتشغيل ومراقبة أنظمة التعلم الآلي. تتيح…

MLOps ونشر النماذج

توفر Together AI منصة ذكاء اصطناعي متكاملة، وهي سحابة الذكاء الاصطناعي الأصلية، للاستدلال والضبط الدقيق ومجموعات معالجات الرسومات (GPU). مدعومة بأبحاث متطورة، مما يوفر استدلالًا…

مميزةمنصّات تعلّم الآلة

منصات الذكاء الاصطناعي

منصة بنية تحتية للذكاء الاصطناعي للمطورين لنشر وتخصيص وتشغيل أكثر من 200 نموذج لغة كبير ونماذج متعددة الوسائط من خلال واجهة برمجة تطبيقات متوافقة مع OpenAI بأسعار الدفع حسب…

مميزةMLOps ونشر النماذج

تطبيقات الذكاء الاصطناعي

Runware هي منصة استدلال للذكاء الاصطناعي التوليدي توفر واجهة برمجة تطبيقات موحدة واحدة لنماذج الصور والفيديو والصوت و3D وLLM والرؤية. تقدم أكثر من 400,000 نموذج، وبنية تحتية…

MLOps ونشر النماذج

منصات الذكاء الاصطناعي

توفر Cerebrium بنية تحتية لوحدات معالجة الرسومات (GPU) بدون خادم للذكاء الاصطناعي في الوقت الفعلي، مما يتيح بدء التشغيل البارد في أقل من ثانية لوكلاء الصوت ونماذج الفيديو ونماذج…

مميزةMLOps ونشر النماذج

منصات الذكاء الاصطناعي

KServe هي منصة مفتوحة المصدر، أصلية لـ Kubernetes، للاستدلال الذاتي للذكاء الاصطناعي. إنها تقدم حلاً موحداً لكل من الذكاء الاصطناعي التوليدي والتنبؤي، مما يبسط عمليات النشر من…

MLOps ونشر النماذج

أطر عمل الذكاء الاصطناعي

OpenVINO هو مجموعة أدوات مفتوحة المصدر لنشر حلول الذكاء الاصطناعي عالية الأداء عبر أجهزة متنوعة. يمكّن المطورين من تحويل وتحسين وتشغيل الاستدلال لكل من نماذج الذكاء الاصطناعي…

أدوات الرؤية الحاسوبية