メインコンテンツへスキップ
ToolPotion

MPNet

MPNetは、BERTやXLNetを改良した言語理解タスク向けの新しい事前学習手法です。様々な事前学習モデルの統一的な実装を提供し、GLUEやSQuADなどの多様な言語理解タスクにおける事前学習およびファインチューニング用のコードをサポートします。

URLを訪問

説明

Microsoftによって開発されたMPNetは、Masked and Permuted Pre-training for Language Understandingの略です。この革新的な事前学習手法は、BERTのMasked Language Modeling (MLM) やXLNetのPermuted Language Modeling (PLM) に見られる既存モデルの限界に対処し、言語理解ベンチマークにおいて優れた精度を達成しています。

このプロジェクトは、BERT、XLNet、そしてMPNet自身を含む複数の事前学習モデルの統一的なビューと実装を提供します。広範な言語理解タスクに対応するため、新しいモデルの事前学習と既存モデルのファインチューニングの両方に対応する包括的なコードが含まれています。サポートされるタスクには、GLUE、SQuAD、RACEといった一般的なベンチマークが含まれており、NLP研究者や開発者にとって汎用性の高いツールとなっています。

fairseqのコードベースを活用することで、インストールは簡単です。ユーザーはpipを通じて必要なコンポーネントをインストールできます。このツールキットには、PyTorch Transformers、SciPy、Scikit-learnが必要です。事前学習プロセスには、トークン化やバイナリ化を含むデータ前処理が含まれ、その後、提供されたスクリプトと設定を使用してMPNetモデルの実際の事前学習が行われます。

MPNetは、その事前学習アプローチにおいて柔軟性を提供します。ユーザーは、それぞれマスク言語モデルまたは順列言語モデルをトレーニングするために、MLMまたはPLMのような入力モードを指定できます。高度なオプションには、モデルアーキテクチャとコマンドライン引数を調整することによる相対位置埋め込みや全単語マスキングの使用が含まれます。このプロジェクトでは、下流タスクでの直接的なファインチューニングのために、更新された事前学習済みMPNetモデルも利用可能になっています。

このプロジェクトはfairseq-0.8.0に基づいて構築されており、その貢献に感謝しています。このツールキットが有益であると感じた方のために、MPNet論文の引用情報が提供されています。関連する研究や代替の事前学習フレームワークもリストされており、NLP研究のより広い文脈を提供しています。このリポジトリは、言語理解能力の向上に役立つ貴重なリソースとして機能します。

MPNetのハイライト

  • マスクおよび順列事前学習手法

  • BERTおよびXLNetに対する精度を向上

  • 事前学習モデルの統一的な実装 (BERT, XLNet, MPNet)

  • 事前学習およびファインチューニング用のコード

  • GLUE, SQuAD, RACEベンチマークをサポート

  • fairseqコードベースに基づく

  • 更新された事前学習済みモデルを提供

  • MLMおよびPLM入力モードをサポート

  • 相対位置埋め込みのオプション

  • 全単語マスキングのオプション

MPNetをはじめる

  1. 依存関係のインストール: pip install fairseq pytorch_transformers==1.0.0 transformers scipy sklearn

  2. データの前処理: encode.pyを使用してコーパスをトークン化し、fairseq-preprocessを使用してバイナリ化

  3. MPNetの事前学習: total updates、learning rate、batch sizeなどの指定されたパラメータでfairseq-trainを実行

  4. 事前学習済みモデルのロード: fairseq.models.masked_permutation_netからMPNet.from_pretrainedを使用

  5. 下流タスクでのファインチューニング: 事前学習済みモデルをGLUEやSQuADなどの特定のNLPタスクに適応させる

MPNetの使用例

  • 言語理解
  • 事前学習モデル
  • NLPモデルのファインチューニング
  • ベンチマークパフォーマンス
  • NLP研究

MPNetのFAQ

MPNet のレビュー

読み込み中...

MPNet に似た人気のAIツール

AI モデル

ConvBERTは、スパンベースの動的畳み込みを特徴とする新しいアーキテクチャを持つ、言語モデルの事前学習のためのオープンソースAIモデルです。このGitHubリポジトリには、V100 GPUでテストされたConvBERTモデルの事前学習およびファインチューニング用のコードが含まれており、TensorFlowでの使用方法も記載されています。

AIモデルとLLM

AI モデル

UniLMは、Microsoftが開発した大規模な自己教師あり事前学習フレームワークです。テキスト、画像、音声を含む多様なタスク、言語、モダリティを横断してモデルが学習できるようにします。このプロジェクトは、高度なAI研究開発のための基盤モデルとツールキットを提供します。

AIモデルとLLM

DeBERTaは、Microsoft Researchによって開発された大規模事前学習済み言語モデルです。T5 11Bモデルを性能で凌駕し、SuperGLUEベンチマークで人間レベルの結果を達成しています。この先進的なモデルは、自然言語理解タスクに顕著な能力を提供します。

AIモデルとLLM

AI モデル

SpanBERTは、テキストの範囲(スパン)の表現と予測に焦点を当てることで、事前学習の改善を目指すAIモデルです。HuggingFace BERTフォーマットと互換性のある、事前学習済みのベースモデルとラージモデルを提供します。このリポジトリには、質問応答や関係抽出を含む様々なNLPタスクでSpanBERTを使用および評価するためのコードが含まれています。

AIモデルとLLM

Phi-2は、Microsoft Researchが開発した27億パラメータの言語モデルです。130億パラメータ未満のモデルの中で最先端のパフォーマンスを示し、優れた推論能力と自然言語理解能力を備えています。Phi-2は、最大25倍大きいモデルと同等またはそれ以上の性能を複雑なベンチマークで達成しており、研究や実験に最適です。

AIモデルとLLM

AI モデル

FNetは、自己注意機構をフーリエ変換に置き換えた効率的なTransformerライクなエンコーダーアーキテクチャです。Google Researchによって開発され、自然言語処理タスクにおいて高性能な代替手段を提供します。このモデルはJax/Flaxで実装されており、事前学習およびファインチューニングのためにGitHubで利用可能です。

AIモデルとLLM

AI モデル

ProphetNetは、自然言語生成に焦点を当てたMSRA NLCチームの研究プロジェクトです。将来情報、共同生成・ランク学習、拡散ベースのテキスト生成などの事前学習済みモデルの公式実装を提供しています。プロジェクトはGitHubでホストされています。

AIモデルとLLM

BigBirdベースモデルは、ブロック疎行列アテンションを使用して、はるかに長いシーケンスを処理できるように拡張されたBERTのTransformerです。マスク言語モデリングのために英語テキストで事前学習されており、最大4096トークンのシーケンスを効率的に処理でき、長文タスクで最先端の結果を達成しています。

AIモデルとLLM