メインコンテンツへスキップ
ToolPotion

Dynamo-Triton オープンソースソフトウェア

NVIDIA Dynamo-Tritonは、TensorRT、PyTorch、ONNXなどのさまざまなフレームワークでAIモデルのデプロイを可能にします。リアルタイム、バッチ処理、ストリーミングワークロードをサポートし、多様なAIアプリケーションに適しています。

URLを訪問
共有

説明

NVIDIA Dynamo-Triton(以前はNVIDIA Triton Inference Serverとして知られていました)は、TensorRT、PyTorch、ONNX、OpenVINO、Python、RAPIDS FILなどの主要なフレームワークでAIモデルのデプロイを容易にするために設計されたオープンソースソフトウェアです。この強力なツールは、動的バッチ処理、同時実行、最適化された構成などの機能を通じて高いパフォーマンスを提供します。Dynamo-Tritonは、リアルタイム、バッチ処理、アンサンブル、音声/ビデオストリーミングなど、さまざまなワークロードをサポートし、NVIDIA GPU、非NVIDIAアクセラレーター、x86、ARM CPU上でシームレスに動作します。

オープンソースソリューションとして、Dynamo-TritonはDevOpsおよびMLOpsワークフローと互換性があり、Kubernetesとの効果的な統合によりスケーリングを実現し、Prometheusによる監視を可能にします。これは、クラウドおよびオンプレミスのAIプラットフォーム全体で機能するように設計されており、NVIDIA AI Enterpriseの一部として、安全で生産準備が整った環境を提供します。この環境には、安定したAPIとAIデプロイメントのための広範なサポートが含まれており、開発者がAIモデルを効率的に管理できるようにします。

大規模言語モデル(LLM)アプリケーション向けに、NVIDIAはLLM推論およびマルチモードデプロイメントに特化したNVIDIA Dynamoなどの追加ツールを提供しています。このツールは、Dynamo-Tritonを補完し、分散サービング、プレフィックスキャッシング、ストレージへのキー・バリューキャッシングなど、LLM特有の最適化を提供します。開発者は、Dynamo-Tritonを使用してAIプロジェクトでその機能を最大限に活用するためのドキュメント、チュートリアル、スターターキットなどの豊富なリソースにアクセスできます。

Dynamo-Triton オープンソースソフトウェアの主要機能

  • オープンソース

  • TensorRT、PyTorch、ONNX、OpenVINOをサポート

  • リアルタイムおよびバッチ処理ワークロード

  • 動的バッチ処理

  • 同時実行

  • Kubernetesとの統合

  • Prometheusとの互換性

  • NVIDIAおよび非NVIDIAハードウェアで動作

  • クラウドおよびオンプレミスのデプロイをサポート

  • LLM特有の最適化が利用可能

Dynamo-Triton オープンソースソフトウェアをはじめる

  1. 設定: AIモデルをデプロイするための環境を設定します。

  2. 統合: Dynamo-Tritonを選択したAIフレームワークと接続します。

  3. デプロイ: Triton Inference Serverを使用してAIモデルを起動します。

  4. 監視: Prometheusを使用してパフォーマンスとリソース使用状況を追跡します。

  5. スケール: 必要に応じてKubernetesを利用してデプロイをスケーリングします。

Dynamo-Triton オープンソースソフトウェアの使用例

  • リアルタイムAI推論
  • バッチ処理
  • 音声/ビデオストリーミング
  • 大規模言語モデル
  • クラウドデプロイメント

Dynamo-Triton オープンソースソフトウェアのFAQ

From NVIDIA

Dynamo-Triton オープンソースソフトウェア のレビュー

読み込み中...

Dynamo-Triton オープンソースソフトウェア に似た人気のAIツール

LiteRTは、エッジプラットフォーム上でGenAIおよびMLモデルを展開するためのGoogleの高性能オンデバイス機械学習フレームワークです。TensorFlow Liteの基盤を活かし、効率的な変換、ランタイム、最適化を提供し、数十億台のデバイスで低遅延と高いプライバシーを実現します。

MLOps・モデルデプロイ

AI フレームワーク

TensorFlow Extended (TFX) は、Google の本番環境スケールの機械学習プラットフォームです。ML システムの定義、起動、監視のための共通コンポーネントを統合するための設定フレームワークと共有ライブラリを提供します。TFX を使用すると、本番環境で ML…

MLOps・モデルデプロイ

Together AIは、推論、ファインチューニング、GPUクラスター向けのフルスタックAIプラットフォームであるAIネイティブクラウドを提供しています。最先端の研究を基盤とし、より高速な推論、低コスト、そして高速な事前トレーニングを実現します。このプラットフォームは、実験から大規模なデプロイまで、AI開発のあらゆる段階をサポートします。

注目機械学習プラットフォーム

AI プラットフォーム

開発者が200以上の最適化されたLLMおよびマルチモーダルモデルをデプロイ、ファインチューニング、実行できるAIインフラストラクチャプラットフォームで、OpenAI互換のAPIを通じて従量課金制で提供されます。

注目MLOps・モデルデプロイ

AI アプリ

Runwareは、画像、動画、音声、3D、LLM、ビジョンモデルのための統一されたAPIを提供する生成AI推論プラットフォームです。400K以上のモデル、管理されたインフラストラクチャ、カスタム推論エンジンに基づいた使用量ベースの価格設定を提供します。

MLOps・モデルデプロイ

AI プラットフォーム

Cerebriumは、リアルタイムAI向けのサーバーレスGPUインフラストラクチャを提供し、音声エージェント、ビデオモデル、LLMのコールドスタートをサブ秒で実現します。インスタントな自動スケーリング、従量課金制(秒単位)、Kubernetes不要な環境を提供し、複雑なインフラ管理なしで本番レベルのAIを容易に利用可能にします。

注目MLOps・モデルデプロイ

AI プラットフォーム

KServeは、セルフホスト型AI推論のためのオープンソース、Kubernetesネイティブプラットフォームです。生成AIと予測AIの両方に対応する統合ソリューションを提供し、GPUアクセラレーションやオートスケーリングなどの機能により、迅速なセットアップから要求の厳しいエンタープライズワークロードまで、デプロイメントを簡素化します。

MLOps・モデルデプロイ

AI フレームワーク

OpenVINOは、多様なハードウェア上で高性能AIソリューションを展開するためのオープンソースツールキットです。開発者は、クラウド、AI PC、エッジデバイスでの効率的なデプロイメントをサポートし、一般的なフレームワークの生成AIおよび従来のAIモデルの両方の変換、最適化、推論実行を可能にします。

コンピュータービジョンツール