Перейти к основному содержимому
ToolPotion

Dynamo-Triton Open-Source Software

NVIDIA Dynamo-Triton позволяет развертывание AI моделей в различных фреймворках, таких как TensorRT, PyTorch и ONNX. Он поддерживает рабочие нагрузки в реальном времени, пакетные и потоковые, что делает его подходящим для разнообразных AI приложений.

Посетить URL
Dynamo-Triton Open-Source Software screenshot

Описание

NVIDIA Dynamo-Triton, ранее известный как NVIDIA Triton Inference Server, является программным обеспечением с открытым исходным кодом, разработанным для упрощения развертывания AI моделей в основных фреймворках, таких как TensorRT, PyTorch, ONNX, OpenVINO, Python и RAPIDS FIL. Этот мощный инструмент обеспечивает высокую производительность благодаря таким функциям, как динамическое пакетирование, параллельное выполнение и оптимизированные конфигурации. Dynamo-Triton способен поддерживать различные рабочие нагрузки, включая рабочие нагрузки в реальном времени, пакетные, ансамблевые и потоковые аудио/видео, и он работает без проблем на графических процессорах NVIDIA, не-NVIDIA ускорителях, x86 и ARM процессорах.

Как решение с открытым исходным кодом, Dynamo-Triton совместим как с DevOps, так и с MLOps рабочими процессами, эффективно интегрируясь с Kubernetes для масштабирования и Prometheus для мониторинга. Он разработан для работы как в облачных, так и в локальных AI платформах, обеспечивая безопасную и готовую к производству среду в рамках NVIDIA AI Enterprise. Эта среда включает стабильные API и обширную поддержку развертывания AI, что гарантирует, что разработчики могут эффективно управлять своими AI моделями.

Для приложений больших языковых моделей (LLM) NVIDIA предлагает дополнительные инструменты, такие как NVIDIA Dynamo, который предназначен для вывода LLM и многорежимного развертывания. Этот инструмент дополняет Dynamo-Triton, предоставляя оптимизации, специфичные для LLM, включая раздельное обслуживание, кэширование префиксов и кэширование ключ-значение для хранения. Разработчики могут получить доступ к множеству ресурсов, включая документацию, учебные пособия и стартовые наборы, чтобы помочь им начать работу с Dynamo-Triton и максимально использовать его возможности в своих AI проектах.

Основные функции Dynamo-Triton Open-Source Software

  • Открытый исходный код

  • Поддерживает TensorRT, PyTorch, ONNX, OpenVINO

  • Рабочие нагрузки в реальном времени и пакетные

  • Динамическое пакетирование

  • Параллельное выполнение

  • Интеграция с Kubernetes

  • Совместимость с Prometheus

  • Работает на оборудовании NVIDIA и не-NVIDIA

  • Поддерживает облачное и локальное развертывание

  • Оптимизации, специфичные для LLM, доступны

Как использовать Dynamo-Triton Open-Source Software?

  1. Настройка: Подготовьте свою среду для развертывания AI моделей.

  2. Интеграция: Подключите Dynamo-Triton к выбранным вами AI фреймворкам.

  3. Развертывание: Запустите свои AI модели с помощью Triton Inference Server.

  4. Мониторинг: Используйте Prometheus для отслеживания производительности и использования ресурсов.

  5. Масштабирование: Используйте Kubernetes для масштабирования ваших развертываний по мере необходимости.

Варианты использования Dynamo-Triton Open-Source Software

  • AI вывод в реальном времени
  • Пакетная обработка
  • Потоковая передача аудио/видео
  • Большие языковые модели
  • Облачное развертывание

Часто задаваемые вопросы Dynamo-Triton Open-Source Software

Отзывы о Dynamo-Triton Open-Source Software

Загрузка...

Популярные ИИ-инструменты, похожие на Dynamo-Triton Open-Source Software

AI-приложения

Runware — это платформа генеративного ИИ для вывода, которая предоставляет единый API для работы с изображениями, видео, аудио, 3D, LLM и визуальными моделями. Она предлагает…

MLOps и развёртывание моделей

AI-приложения

ZETIC Melange автоматизирует развертывание ИИ на устройствах для любой модели на любом устройстве. Разработанный бывшими инженерами Qualcomm, он оптимизирует ускорение NPU,…

MLOps и развёртывание моделей

AI-платформы

Платформа ИИ-инфраструктуры для разработчиков, позволяющая развертывать, настраивать и запускать более 200 оптимизированных LLM и мультимодальных моделей через один совместимый с…

РекомендованоMLOps и развёртывание моделей

Together AI предоставляет полнофункциональную платформу ИИ, облако, нативное для ИИ, для вывода, тонкой настройки и кластеров GPU. Она основана на передовых исследованиях,…

РекомендованоИИ-модели и LLM

Поставщик высокоскоростного вывода ИИ, который обслуживает модели на специализированной инфраструктуре ASIC через совместимый с OpenAI API, предлагая низкое время до первого…

MLOps и развёртывание моделей

RunInfra — это платформа оптимизации AI-моделей, ориентированная на чат, которая проводит бенчмаркинг GPU, оптимизирует ядра и разворачивает производственные API. Она позволяет…

MLOps и развёртывание моделей

AI-приложения

Atlas Cloud предоставляет разработчикам единый API для доступа к более чем 400 AI моделям для работы с изображениями, видео, аудио и чатами. Это упрощает интеграцию и предлагает…

AI-инструменты для DevOps и облака

AI-приложения

Salad предлагает распределенное GPU-облако с более чем 60 000 активных GPU в день по цене от 0,02 доллара США в час. Оно обеспечивает недорогие вычисления в больших масштабах для…

AI-помощники для программирования