説明
ML Kitは、Googleの高度な機械学習機能をAndroidおよびiOSアプリケーションに直接組み込むための、強力で無料のモバイルソフトウェア開発キット(SDK)です。開発者には、すべてオンデバイスで実行される、使いやすいVision APIとNatural Language APIのスイートが提供されます。このオンデバイス実行により、ライブカメラストリームと対話したり、即時のフィードバックを必要とするアプリケーションにとって重要なリアルタイム処理が可能になり、オフラインでも機能が保証されます。
開発者は、ML Kitの事前構築済みAPIを活用して、幅広い一般的なタスクを実行できます。これには、テキスト認識、顔検出、バーコードスキャン、画像ラベリング、オブジェクト検出と追跡、ポーズ検出、セルフィーセグメンテーション、スマートリプライ、テキスト翻訳、言語識別が含まれます。より高度または特殊なニーズに対応するため、ML KitはカスタムTensorFlow Liteモデルの統合もサポートしており、モバイルアプリ内で高度にカスタマイズされた機械学習ソリューションを実現できます。
最近のアップデートでは、Gemini Nanoによって強化されたエキサイティングな生成AI(GenAI)機能が導入されました。Prompt APIのアルファ版は、カスタムプロンプトに基づいたテキストコンテンツ生成を可能にし、ベータ版のGenAI APIは、高レベルのインターフェースを通じて、画像説明、校正、書き換え、要約などの一般的なユースケースで、すぐに利用できる品質を提供します。これらの新機能により、開発者は革新的なユーザーエクスペリエンスを創造し、最先端のAIで複雑な課題を解決できるようになります。
Googleは、サンプルアプリ、コーディングラボ、広範なドキュメントを含む包括的なリソースを提供し、開発者の採用を促進しています。これらのリソースは、開発者がML Kitの機能を迅速に開始し、効果的に実装するのに役立つように設計されています。ML Kitのほとんどは一般的に利用可能ですが、ポーズ検出やテキスト認識v2などの一部の高度な機能は現在ベータ版であり、最新の進歩への早期アクセスを提供しています。
ML Kitは、クラウドベースのMLインフラストラクチャの管理の複雑さを伴わずに、インテリジェントな機能でアプリケーションを強化したいモバイル開発者に最適です。オンデバイスの性質により、プライバシー、速度、オフラインアクセスが保証され、幅広いモバイルアプリケーション向けの汎用性の高いツールとなっています。ターンキーAPIを超えるカスタムソリューションを必要とするユーザー向けに、Googleはより広範なオンデバイス機械学習ツールおよびソリューションに関するガイダンスも提供しています。
ML Kitの主要機能
AndroidおよびiOS向けのオンデバイス機械学習
使いやすいVision API
使いやすいNatural Language API
リアルタイム処理機能
オフライン機能
一般的なタスク向けの事前構築済みAPI
カスタムTensorFlow Liteモデルのサポート
Gemini Nanoによる生成AI API
テキスト生成用のPrompt API
画像説明API
校正API
書き換えAPI
要約API
テキスト認識API
顔検出API
バーコードスキャンAPI
画像ラベリングAPI
オブジェクト検出および追跡API
ポーズ検出API
セルフィーセグメンテーションAPI
スマートリプライAPI
テキスト翻訳API
言語識別API
ML Kitをはじめる
統合:ML Kit SDKをAndroidまたはiOSプロジェクトに追加します。
設定:目的のML Kit APIを選択し、設定します。
開発:特定のMLタスクのためにAPI呼び出しを実装します。
テスト:ガイダンスのためにサンプルアプリとコーディングラボを実行します。
デプロイ:ML Kit機能を備えたアプリをビルドしてデプロイします。
ML Kitの使用例
- リアルタイム画像分析
- オフライン言語翻訳
- コンテンツ要約
- 自動テキスト校正
- バーコードおよびテキストスキャン
- スマートリプライの提案
- カスタムモデルの統合
- 画像説明生成







