説明
Qwen3-0.6Bは、Qwenシリーズの最新のイテレーションであり、大規模言語モデルの限界を押し広げることを目的としています。推論、指示に従う能力、エージェント機能において画期的な進展をもたらすために、広範なトレーニングに基づいて構築された密なモデルと専門家の混合(MoE)モデルの包括的なスイートを提供します。このモデルは、複雑な論理的推論、数学、コーディングのための思考モードと、効率的で汎用的な対話のための非思考モードの間でシームレスに切り替えることをサポートします。これにより、さまざまなシナリオで最適なパフォーマンスが確保されます。
Qwen3-0.6Bは、推論能力を大幅に向上させており、数学、コード生成、常識的論理推論において以前のモデルを超えています。人間の好みに密接に一致し、創造的な執筆、ロールプレイ、多ターン対話、指示に従う能力に優れ、より自然で魅力的、没入感のある会話体験を提供します。エージェント機能における専門知識により、外部ツールとの正確な統合が可能であり、複雑なエージェントベースのタスクにおいてオープンソースモデルの中でトップクラスのパフォーマンスを達成しています。
このモデルは、100以上の言語と方言をサポートし、多言語の指示に従う能力と翻訳能力に優れています。0.6億のパラメータを持つ因果言語モデルであり、0.44億の非埋め込みパラメータ、28層、Q用の16の注意ヘッド、KV用の8の注意ヘッドを含んでいます。コンテキストの長さは32,768トークンであり、詳細な応答を生成するための十分なスペースを提供します。
Qwen3-0.6Bは、最新のHugging Faceトランスフォーマーに統合されており、Ollama、LMStudio、MLX-LM、llama.cpp、KTransformersなどのローカルアプリケーションをサポートしています。ユーザー入力を介して思考モードと非思考モードの切り替えを含む高度な使用オプションを提供し、Qwen-Agentを使用したツール呼び出し機能に優れています。最適なパフォーマンスを得るために、特定のサンプリングパラメータと出力長が推奨されます。
Qwen3-0.6Bモデルのハイライト
密なモデルとMoEモデル
シームレスなモード切り替え
強化された推論能力
人間の好みに合わせた調整
エージェント統合
多言語サポート
因果言語モデル
広範なパラメータ数
Qwen3-0.6Bモデルをはじめる
ページにアクセス: Hugging Faceを訪問
モデルを読み込む: transformersライブラリを使用
環境を設定: パラメータを設定
統合: ローカルアプリケーションと使用
ファインチューニング: 特定のタスクに調整
Qwen3-0.6Bモデルの使用例
- 多言語翻訳
- 複雑な推論
- 創造的な執筆
- エージェント統合
- 指示に従う










