Description
L'interface web Stable Diffusion, développée par AUTOMATIC1111, fournit une interface puissante et conviviale pour interagir avec les modèles Stable Diffusion. Construite à l'aide de la bibliothèque Gradio, elle simplifie le processus complexe de génération d'images par IA, le rendant accessible à un public plus large. L'interface prend en charge les modes txt2img et img2img d'origine, ainsi que des fonctionnalités avancées telles que l'outpainting, l'inpainting et le color sketching.
Les capacités clés incluent la génération de matrices de prompts, le contrôle de l'attention pour des parties spécifiques des prompts et le traitement en boucle pour les tâches img2img itératives. La fonctionnalité de graphique X/Y/Z permet de visualiser les variations d'images sur différents paramètres. Pour les utilisateurs intéressés par des modèles d'IA personnalisés, l'interface web prend en charge l'Inversion Textuelle, permettant l'utilisation de plusieurs embeddings personnalisés. L'onglet 'Extras' intègre des outils puissants tels que GFPGAN et CodeFormer pour la restauration de visages, et divers upscalers de réseaux neuronaux comme RealESRGAN, ESRGAN, SwinIR, Swin2SR et LDSR.
Améliorant encore son utilité, l'interface offre un contrôle détaillé sur les méthodes d'échantillonnage, les valeurs eta et les paramètres de bruit, avec une prise en charge de la faible VRAM (4 Go et même 2 Go signalés) et du traitement interruptible. Les paramètres de génération sont enregistrés avec les images, permettant une restauration facile. Les fonctionnalités avancées incluent la prise en charge du tiling, la prévisualisation en direct, les prompts négatifs, les styles pour l'enregistrement des prompts, les variations, le redimensionnement des seeds, l'interrogateur CLIP pour la devinette de prompts et l'édition de prompts en cours de génération. Le traitement par lots et une méthode img2img alternative sont également disponibles.
L'interface web prend en charge Highres Fix pour la génération d'images haute résolution en un clic, le rechargement de checkpoints à la volée et un fusionneur de checkpoints. Elle permet également des scripts et extensions personnalisés, y compris Composable-Diffusion pour la génération multi-prompts et l'intégration DeepDanbooru pour le marquage d'anime. Les limites de tokens des prompts sont supprimées, et les xformers sont pris en charge pour des augmentations de vitesse significatives. L'onglet d'entraînement offre des options pour les hypernetworks et les embeddings, avec des capacités de prétraitement comme le recadrage et l'autotagging.
L'installation est simplifiée avec des scripts en un clic pour Windows et des scripts d'installation automatique pour Linux et macOS. Le projet prend également en charge Stable Diffusion 2.0, Alt-Diffusion et Segmind Stable Diffusion, avec des options pour charger des checkpoints au format safetensors et des restrictions de résolution assouplies. L'interface elle-même est personnalisable, permettant aux utilisateurs de réorganiser les éléments. Le projet est open-source sous la licence AGPL-3.0, favorisant les contributions et le développement de la communauté.
Fonctionnalités principales de Stable Diffusion Web UI
Génération texte-vers-image (txt2img)
Génération image-vers-image (img2img)
Capacités d'outpainting et d'inpainting
Contrôle avancé des prompts avec attention et pondération
Graphique X/Y/Z pour la visualisation des paramètres
Inversion Textuelle pour les embeddings personnalisés
Restauration de visages avec GFPGAN et CodeFormer
Plusieurs upscalers de réseaux neuronaux (RealESRGAN, ESRGAN, SwinIR, etc.)
Prise en charge de faible VRAM (4 Go et 2 Go)
Paramètres de génération enregistrés avec les images
Prise en charge du tiling pour les textures sans couture
Fonctionnalité de prompt négatif
Styles pour enregistrer et appliquer des extraits de prompts
Traitement par lots pour plusieurs fichiers
Highres Fix pour des images haute résolution en un clic
Outil de fusion de checkpoints
Prise en charge de scripts et extensions personnalisés
Composable-Diffusion pour la génération multi-prompts
Intégration DeepDanbooru pour le marquage d'anime
xformers pour des augmentations de vitesse significatives
Onglet d'entraînement pour hypernetworks et embeddings
Prise en charge du format de checkpoint Safetensors
Premiers pas avec Stable Diffusion Web UI
Cloner : Clonez le dépôt stable-diffusion-webui depuis GitHub.
Installer les dépendances : Installez Python 3.10.6 et Git, puis exécutez le script d'installation approprié (par exemple, webui-user.bat ou webui.sh).
Configurer : Configurez les variables d'environnement ou les arguments de ligne de commande selon vos besoins (par exemple, --xformers).
Exécuter : Lancez le script webui.bat ou webui.sh pour démarrer l'interface.
Générer : Accédez à l'interface web dans votre navigateur et commencez à créer des images en utilisant divers modes et paramètres.
Améliorer : Utilisez l'onglet 'Extras' pour l'upscaling et la restauration de visages, ou explorez les scripts et extensions personnalisés.
Entraîner : Utilisez l'onglet 'Entraînement' pour créer des embeddings ou des hypernetworks personnalisés.
Cas d'utilisation de Stable Diffusion Web UI
- Génération d'art IA
- Édition et amélioration d'images
- Conception de personnages et de concepts
- Création de textures
- Restauration de visages
- Entraînement et personnalisation de modèles
- Prototypage visuel
- Génération d'images d'anime




