メインコンテンツへスキップ
ToolPotion

Phi-4-reasoning-plus モデル

Phi-4-reasoning-plusは、Microsoft Researchによって開発された最先端の推論モデルです。Phi-4からスーパーバイズド・ラーニングと強化学習を用いてファインチューニングされ、数学、科学、コーディングにおける高度な推論タスクのために設計されています。

モデルを見る
共有

説明

Phi-4-reasoning-plusは、Microsoft Researchによって開発された高度な推論モデルです。これは、思考の連鎖のトレースのデータセットに対してスーパーバイズド・ラーニングを使用し、Phi-4モデルからファインチューニングされています。このモデルは、特に数学、科学、コーディングにおける推論タスクで優れた性能を発揮するように設計されています。14億のパラメータを持つ密なデコーダー専用のトランスフォーマーアーキテクチャを使用し、特にチャット形式のテキスト入力に最適化されています。モデルのトレーニングには、32台のH100-80G GPUを使用して、約2.5日間で160億トークン、約83億のユニークトークンが含まれました。このモデルは、推論の思考の連鎖ブロックと要約ブロックを生成し、深い多段階の推論や広範なコンテキストを必要とするタスクに適しています。

Phi-4-reasoning-plusは、AIME、GPQA-Diamond、OmniMath、LiveCodeBenchなどのさまざまなベンチマークで評価され、推論集約型タスクにおいて強力なパフォーマンスを示しています。このモデルは、Ollama、llama.cpp、Phi-4互換のフレームワークなどのフレームワークによってもサポートされています。MITライセンスの下でリリースされ、一般的なAIシステムやアプリケーションでの使用を意図しており、特にメモリや計算リソースが制約されている環境やレイテンシに制約のあるシナリオでの使用に適しています。

このモデルは、Microsoftの安全ガイドラインに従ったスーパーバイズド・ファインチューニングを通じて、堅牢な安全性のポストトレーニングアプローチを組み込んでいます。敵対的な会話シミュレーションやMicrosoftの独立したAIレッドチームによる評価を含む広範な安全評価を受けています。その能力にもかかわらず、開発者はモデルの限界、例えば潜在的なバイアス、不正確さ、選挙に重要なクエリにおける欠陥率の上昇について認識しておく必要があります。開発者は責任あるAIのベストプラクティスを適用し、モデルを展開する際には関連する法律や規制を遵守することが推奨されます。

Phi-4-reasoning-plus モデルのハイライト

  • 最先端の推論モデル

  • Phi-4からファインチューニング

  • 140億のパラメータ

  • 密なデコーダー専用トランスフォーマーアーキテクチャ

  • 160億トークンでトレーニング

  • チャット形式の入力をサポート

  • 推論の思考の連鎖と要約ブロックを生成

  • 堅牢な安全性のポストトレーニングアプローチ

Phi-4-reasoning-plus モデルをはじめる

  1. ページにアクセス: Hugging Faceモデルページを訪問

  2. モデルをロード: Phi-4-reasoning-plusモデルをダウンロードしてロード

  3. 環境を設定: 必要な依存関係で環境を設定

  4. 統合: アプリケーションでモデルを使用

  5. ファインチューニング: 必要に応じて特定のタスクにモデルを調整

Phi-4-reasoning-plus モデルの使用例

  • 高度な推論
  • コーディング支援
  • 研究の加速
  • 一般的なAI
  • メモリ制約のある環境

Phi-4-reasoning-plus モデルのFAQ

From Microsoft

a model in Phi-2 言語モデル.

Phi-4-reasoning-plus モデル のレビュー

読み込み中...

Phi-4-reasoning-plus モデル に似た人気のAIツール

Phi-4-reasoning-vision-15Bは、Microsoftによって開発されたマルチモーダルAIモデルで、視覚と言語の理解および推論能力を必要とするタスクに設計されています。科学的推論やコンピュータ使用エージェントタスクに優れており、さまざまなアプリケーションに適しています。

注目AIモデルとLLM

DeepSeek-R1は、強化学習を通じて問題解決能力を向上させるために開発された高度なAI推論モデルです。オープンソースでモデルへのアクセスを提供することで、研究者や開発者がその高度な推論機能を効果的に活用できるようにすることを目指しています。

注目AIモデルとLLM

SmolLM3は、3Bパラメータの言語モデルであり、小型モデルの限界を押し広げることを目的としています。デュアルモード推論、6言語、長いコンテキスト処理をサポートし、3B–4Bスケールで強力なパフォーマンスを提供します。

AIモデルとLLM

Falcon-H1R-7Bは、数学、プログラミング、論理タスクにおけるパフォーマンスを向上させるために設計された推論専門のAIモデルです。テクノロジーイノベーション研究所によって開発され、効率的な推論とテスト時のスケーリングのためにハイブリッドアーキテクチャを利用しています。

注目AIモデルとLLM

Mistral Small 4は、推論、コーディング、マルチモーダル機能を1つのプラットフォームに統合した多用途のAIモデルです。ユーザーはAIアシスタントやエージェントを効率的にカスタマイズ、ファインチューニング、展開できるため、さまざまな企業アプリケーションに最適です。

注目AIモデルとLLM

Phi-2は、Microsoft Researchが開発した27億パラメータの言語モデルです。130億パラメータ未満のモデルの中で最先端のパフォーマンスを示し、優れた推論能力と自然言語理解能力を備えています。Phi-2は、最大25倍大きいモデルと同等またはそれ以上の性能を複雑なベンチマークで達成しており、研究や実験に最適です。

AIモデルとLLM

DeepSeek-V3.2は、効率的な推論とエージェントタスクのために設計された高度なAIモデルです。DeepSeekスパースアテンション、スケーラブルな強化学習、そして大規模なエージェントタスク合成パイプラインを特徴としています。

AIモデルとLLM

AI モデル

DeepSeek R1 Onlineは、高度な推論能力を持つオープンソースAIモデルであり、OpenAIのo1を上回る性能を発揮します。370億の活性パラメータと128Kのコンテキスト長を持つMixture of Expertsアーキテクチャを採用し、複雑な問題解決に最適化されています。数学、コーディング、一般的な推論タスクにおいて高い精度を提供し、コスト効…

AIモデルとLLM