説明
AUTOMATIC1111によって開発されたStable Diffusion web UIは、Stable Diffusionモデルとの対話のための強力でユーザーフレンドリーなインターフェースを提供します。Gradioライブラリを使用して構築されており、AI画像生成の複雑なプロセスを簡素化し、より幅広いユーザーがアクセスできるようにします。UIは、オリジナルのtxt2imgおよびimg2imgモードに加え、アウトペインティング、インペインティング、カラー スケッチなどの高度な機能もサポートしています。
主な機能には、プロンプトマトリックス生成、プロンプトの特定部分へのアテンション制御、反復的なimg2imgタスクのためのループバック処理が含まれます。X/Y/Zプロット機能により、さまざまなパラメータにわたる画像バリエーションを視覚化できます。カスタムAIモデルに関心のあるユーザー向けに、web UIはTextual Inversionをサポートしており、複数のカスタム埋め込みの使用を可能にします。「Extras」タブには、顔の復元のためのGFPGANやCodeFormer、およびRealESRGAN、ESRGAN、SwinIR、Swin2SR、LDSRなどのさまざまなニューラルネットワークアップスケーラーなどの強力なツールが統合されています。
さらにその有用性を高めるために、インターフェースはサンプリング方法、eta値、ノイズ設定の詳細な制御を提供し、低VRAM(4GB、さらには2GBも報告されています)と中断可能な処理をサポートしています。生成パラメータは画像とともに保存されるため、簡単に復元できます。高度な機能には、タイリングサポート、ライブプレビュー、ネガティブプロンプト、プロンプト保存用のスタイル、バリエーション、シードリサイズ、プロンプト推測のためのCLIPインターロゲーター、生成中のプロンプト編集が含まれます。バッチ処理と代替img2imgメソッドも利用可能です。
web UIは、Highres Fixをサポートしており、ワンクリックで高解像度の画像生成、オンザフライでのチェックポイントリロード、およびチェックポイントマージャーが可能です。また、マルチプロンプト生成のためのComposable-Diffusionや、アニメタグ付けのためのDeepDanbooru統合を含むカスタムスクリプトと拡張機能もサポートしています。プロンプトトークンの制限は削除され、xformersは大幅な速度向上をサポートしています。トレーニングタブは、ハイパーネットワークと埋め込みのオプションを提供し、クロッピングや自動タグ付けなどの前処理機能も備えています。
インストールは、Windows用のワンクリック スクリプトと、LinuxおよびmacOS用の自動インストール スクリプトで合理化されています。このプロジェクトは、Stable Diffusion 2.0、Alt-Diffusion、Segmind Stable Diffusionもサポートしており、safetensors形式のチェックポイントをロードするオプションと、解像度の制限の緩和も提供しています。インターフェース自体はカスタマイズ可能で、ユーザーは要素の順序を変更できます。このプロジェクトはAGPL-3.0ライセンスの下でオープンソースであり、コミュニティの貢献と開発を促進しています。
Stable Diffusion Web UIの主要機能
テキストから画像への生成 (txt2img)
画像から画像への生成 (img2img)
アウトペインティングおよびインペインティング機能
アテンションと重み付けによる高度なプロンプト制御
パラメータ視覚化のためのX/Y/Zプロット
カスタム埋め込みのためのTextual Inversion
GFPGANおよびCodeFormerによる顔の復元
複数のニューラルネットワークアップスケーラー (RealESRGAN, ESRGAN, SwinIRなど)
低VRAMサポート (4GBおよび2GB)
画像とともに保存される生成パラメータ
シームレスなテクスチャのためのタイリングサポート
ネガティブプロンプト機能
プロンプトスニペットの保存と適用用のスタイル
複数ファイルのためのバッチ処理
ワンクリックで高解像度画像を作成するHighres Fix
チェックポイントマージャーツール
カスタムスクリプトおよび拡張機能サポート
マルチプロンプト生成のためのComposable-Diffusion
アニメタグ付けのためのDeepDanbooru統合
大幅な速度向上を実現するxformers
ハイパーネットワークおよび埋め込みのためのトレーニングタブ
Safetensorsチェックポイント形式サポート
Stable Diffusion Web UIをはじめる
クローン: stable-diffusion-webuiリポジトリをGitHubからクローンします。
依存関係のインストール: Python 3.10.6とGitをインストールし、適切なインストールスクリプト(例: webui-user.batまたはwebui.sh)を実行します。
設定: 必要に応じて環境変数またはコマンドライン引数(例: --xformers)を設定します。
実行: webui.batまたはwebui.shスクリプトを実行してインターフェースを起動します。
生成: ブラウザでWeb UIにアクセスし、さまざまなモードとパラメータを使用して画像の作成を開始します。
強化: 「Extras」タブを使用してアップスケーリングと顔の復元を行ったり、カスタムスクリプトや拡張機能を探索したりします。
トレーニング: 「Training」タブを使用してカスタム埋め込みまたはハイパーネットワークを作成します。
Stable Diffusion Web UIの使用例
- AIアート生成
- 画像編集と強化
- キャラクターとコンセプトデザイン
- テクスチャ作成
- 顔の復元
- モデルトレーニングとカスタマイズ
- ビジュアルプロトタイピング
- アニメ画像生成




