メインコンテンツへスキップ
ToolPotion

SmolLM3 言語モデル

SmolLM3は、3Bパラメータの言語モデルであり、小型モデルの限界を押し広げることを目的としています。デュアルモード推論、6言語、長いコンテキスト処理をサポートし、3B–4Bスケールで強力なパフォーマンスを提供します。

モデルを見る
共有

説明

SmolLM3は、人工知能における小型モデルの能力を向上させるために開発された30億パラメータの言語モデルです。デュアルモード推論をサポートし、英語、フランス語、スペイン語、ドイツ語、イタリア語、ポルトガル語の6言語をネイティブにサポートする多言語対応です。このモデルは完全にオープンで、オープンウェイトと包括的なトレーニング詳細が提供されており、公開データの混合やトレーニング構成が含まれています。

SmolLM3のアーキテクチャは、GQAとNoPEを使用したデコーダー専用のトランスフォーマーで、3:1の比率です。ウェブ、コード、数学、推論データを含む段階的カリキュラムを使用して、112兆トークンで事前トレーニングされました。トレーニング後は、1400億の推論トークンでの中間トレーニングを行い、その後、監視付きファインチューニングとAnchored Preference Optimization (APO)による整合性を確保しました。

SmolLM3はハイブリッド推論に最適化されており、64kコンテキストでトレーニングされ、YARN外挿を使用して最大128kトークンを処理する能力があります。このモデルはvLLMおよびSGLangを使用してデプロイ可能で、OpenAIフォーマットのAPIと互換性があります。また、ツール呼び出しをサポートしており、XMLまたはPython関数呼び出しを介してさまざまなツールと統合できます。

ローカル推論のために、SmolLM3はllama.cpp、ONNX、MLX、MLC、ExecuTorchと共に使用できます。効率的なデプロイのために量子化されたチェックポイントが利用可能です。このモデルのパフォーマンスはさまざまなベンチマークで評価されており、多言語Q&A、競技プログラミング、指示に従うタスクで強力な結果を示しています。

SmolLM3は、多言語および複雑な推論タスクのためにAIを活用しようとする開発者や研究者にとって貴重なツールです。ただし、生成されたコンテンツは常に事実に基づいているわけではなく、トレーニングデータに存在するバイアスから自由でない可能性があることに注意する必要があります。

SmolLM3 言語モデルのハイライト

  • 30億パラメータの言語モデル

  • デュアルモード推論をサポート

  • 多言語対応:6言語

  • 最大128kトークンの長いコンテキスト処理

  • オープンモデルでオープンウェイト

  • ハイブリッド推論に最適化された指示モデル

  • ツール呼び出しのサポート

  • vLLMおよびSGLangと互換性

SmolLM3 言語モデルをはじめる

  1. ページにアクセス:Hugging Faceモデルページを訪問

  2. モデルをロード:transformers v4.53.0または最新のvllmを使用

  3. 環境を設定:サンプリングパラメータとコンテキストの長さを設定

  4. 統合:XMLまたはPython関数を使用してツール呼び出しを行う

  5. ファインチューニング:監視付きファインチューニングと整合性を適用

SmolLM3 言語モデルの使用例

  • 多言語Q&A
  • ハイブリッド推論
  • ツール統合
  • 長いコンテキスト処理
  • 指示に従う

SmolLM3 言語モデルのFAQ

From Hugging Face

SmolLM3 言語モデル のレビュー

読み込み中...

SmolLM3 言語モデル に似た人気のAIツール

Qwen3-8Bは、高度な推論、指示に従う能力、そして多言語サポートのために設計された大規模言語モデルです。さまざまなシナリオで最適なパフォーマンスを発揮するためのシームレスなモード切替機能を備えており、AIにおける多様なアプリケーションに適しています。

注目AIモデルとLLM

Gemma 3-27B ITは、テキストと画像の入力を処理してテキスト出力を生成することができる、Googleの最先端のマルチモーダルAIモデルです。140以上の言語をサポートし、リソースが限られた環境での効率的な展開を目的としています。

AIモデルとLLM

Falcon3-10B-Instructは、推論、言語理解、指示に従うタスクのために設計された最先端の言語モデルです。複数の言語をサポートし、理解を高めるための長いコンテキスト長を提供します。

AIモデルとLLM

AI モデル

Tencent HunyuanによるHy3 Previewは、2950億のパラメータを持つオープンソースの言語モデルです。数学、コーディング、マルチリンガルタスクに優れ、256Kのコンテキストウィンドウを持つ競争力のあるパフォーマンスを提供します。Tencent CloudおよびOpenRouterで利用可能です。

AIモデルとLLM

Kimi K3は、長期的なコーディング、知識作業、推論のために設計された高度なオープンウェイトのマルチモーダルAIモデルです。1百万トークンのコンテキストウィンドウを備え、効率とパフォーマンスを向上させる革新的なアーキテクチャに基づいています。

注目AIモデルとLLM

Phi-4-reasoning-plusは、Microsoft Researchによって開発された最先端の推論モデルです。Phi-4からスーパーバイズド・ラーニングと強化学習を用いてファインチューニングされ、数学、科学、コーディングにおける高度な推論タスクのために設計されています。

AIモデルとLLM

Mistral Small 4は、推論、コーディング、マルチモーダル機能を1つのプラットフォームに統合した多用途のAIモデルです。ユーザーはAIアシスタントやエージェントを効率的にカスタマイズ、ファインチューニング、展開できるため、さまざまな企業アプリケーションに最適です。

注目AIモデルとLLM

Llama-3.1-8B-Instructは、Metaによって開発された多言語大規模言語モデルで、指示ベースのタスクに最適化されています。商業および研究用途向けに設計されており、自然言語理解と生成において高度な機能を提供します。

注目AIモデルとLLM