説明
Kling O1(Omni One)は、クリエイターが1つのエンジンからテキスト、画像、動画の入力を通じて動画を生成・編集できる統合AI動画モデルです。ユーザーは、各フレームに対してディレクター級の制御を行うことができ、簡単な言葉で動画を編集し、ネイティブオーディオを同期させ、詳細が間違っている場合でもクリップをゼロから再生成するのではなく、一貫したストーリーを語ることができます。
その会話型編集は、ディレクターのように反応します。「天気を雨に変える」「通行人を削除する」「ドレスを赤にする」といったプロンプトは、テクスチャーや物理を維持しながら、背景をきれいにインペイントしつつ正確に適用されます。Kling O1は、テキスト、画像、動画の入力を統合するマルチモーダルビジョン・ランゲージ(MVL)アーキテクチャに基づいて構築されており、ユーザーはテキストと画像を組み合わせて静的なキャラクターをアニメーション化したり、参照画像のスタイルをホームビデオに転送したり、既存のクリップの環境を再想像したりすることができます。このモデルは、単にピクセルを理解するのではなく、シーンの物理を理解します。統一されたモデルで、Video-to-Video、Image-to-Video、Text-to-Videoをサポートしています。
Kling O1は、ストーリーボードやプリビジュアライゼーションシーンを視覚化する映画製作者、静的な製品写真を動画広告に変えるマーケター、スクリプトのムードに合った著作権フリーのBロールを生成するコンテンツクリエイターを対象としています。価格は月額9.9ドルから始まります。
Kling O1の主要機能
テキストから動画、画像から動画、動画から動画のための統一モデル
簡単な言葉のプロンプトによる会話型編集
再着色、オブジェクト削除、天候変更などの正確な編集
テキスト、画像、動画を組み合わせたMVLマルチモーダルアーキテクチャ
シーンの物理を考慮した理解
ネイティブオーディオの同期
参照画像のスタイルを映像に転送
一貫した被写体とシネマティックな動き
Kling O1の使い方は?
モードを選択: 統一モデルを使用してVideo-to-Video、Image-to-Video、またはText-to-Videoの間で切り替えます。
入力を提供: テキスト、画像、または既存のクリップを追加して生成または編集をガイドします。
言葉で編集: 通行人を削除する、天候を変更するなどの変更を説明し、AIが正確に適用します。
生成と洗練: ネイティブオーディオ付きで動画を生成し、ゼロから再生成することなく反復します。
Kling O1の使用例
- 会話型動画編集
- 製品動画広告
- ストーリーボードとプリビジュアライゼーション
- Bロール生成
- スタイル転送




