Descripción
La interfaz web de Stable Diffusion, desarrollada por AUTOMATIC1111, proporciona una interfaz potente y fácil de usar para interactuar con modelos de Stable Diffusion. Construida utilizando la biblioteca Gradio, simplifica el complejo proceso de generación de imágenes con IA, haciéndolo accesible a un público más amplio. La interfaz admite los modos originales txt2img e img2img, junto con funcionalidades avanzadas como outpainting, inpainting y bocetos de color.
Las capacidades clave incluyen la generación de matrices de prompts, control de atención para partes específicas de los prompts y procesamiento de bucle para tareas iterativas de img2img. La función de gráfico X/Y/Z permite visualizar variaciones de imágenes a través de diferentes parámetros. Para los usuarios interesados en modelos de IA personalizados, la interfaz web admite Textual Inversion, lo que permite el uso de múltiples embeddings personalizados. La pestaña 'Extras' integra potentes herramientas como GFPGAN y CodeFormer para la restauración facial, y varios escaladores de redes neuronales como RealESRGAN, ESRGAN, SwinIR, Swin2SR y LDSR.
Mejorando aún más su utilidad, la interfaz ofrece un control detallado sobre los métodos de muestreo, los valores eta y la configuración de ruido, con soporte para VRAM baja (se han reportado 4 GB e incluso 2 GB) y procesamiento interrumpible. Los parámetros de generación se guardan con las imágenes, lo que permite una fácil restauración. Las funciones avanzadas incluyen soporte de tiling, vista previa en vivo, prompts negativos, estilos para guardar prompts, variaciones, redimensionamiento de semillas, interrogador CLIP para adivinar prompts y edición de prompts a mitad de la generación. También están disponibles el procesamiento por lotes y un método alternativo de img2img.
La interfaz web admite Highres Fix para la generación de imágenes de alta resolución con un solo clic, recarga de checkpoints sobre la marcha y un fusionador de checkpoints. También permite scripts y extensiones personalizados, incluyendo Composable-Diffusion para la generación de múltiples prompts e integración de DeepDanbooru para etiquetado de anime. Se eliminan los límites de tokens de prompt y se admiten xformers para aumentos significativos de velocidad. La pestaña de entrenamiento ofrece opciones para hypernetworks y embeddings, con capacidades de preprocesamiento como recorte y autotagging.
La instalación se simplifica con scripts de un solo clic para Windows y scripts de instalación automática para Linux y macOS. El proyecto también admite Stable Diffusion 2.0, Alt-Diffusion y Segmind Stable Diffusion, con opciones para cargar checkpoints en formato safetensors y restricciones de resolución simplificadas. La interfaz en sí es personalizable, lo que permite a los usuarios reordenar elementos. El proyecto es de código abierto bajo la licencia AGPL-3.0, fomentando las contribuciones y el desarrollo de la comunidad.
Características principales de Stable Diffusion Web UI
Generación de texto a imagen (txt2img)
Generación de imagen a imagen (img2img)
Capacidades de outpainting e inpainting
Control avanzado de prompts con atención y ponderación
Gráfico X/Y/Z para visualización de parámetros
Textual Inversion para embeddings personalizados
Restauración facial con GFPGAN y CodeFormer
Múltiples escaladores de redes neuronales (RealESRGAN, ESRGAN, SwinIR, etc.)
Soporte de VRAM baja (4 GB y 2 GB)
Parámetros de generación guardados con imágenes
Soporte de tiling para texturas sin fisuras
Funcionalidad de prompt negativo
Estilos para guardar y aplicar fragmentos de prompts
Procesamiento por lotes para múltiples archivos
Highres Fix para imágenes de alta resolución con un solo clic
Herramienta de fusión de checkpoints
Soporte de scripts y extensiones personalizadas
Composable-Diffusion para generación de múltiples prompts
Integración de DeepDanbooru para etiquetado de anime
xformers para aumentos significativos de velocidad
Pestaña de entrenamiento para hypernetworks y embeddings
Soporte de formato de checkpoint Safetensors
Primeros pasos con Stable Diffusion Web UI
Clonar: Clone el repositorio stable-diffusion-webui desde GitHub.
Instalar dependencias: Instale Python 3.10.6 y Git, luego ejecute el script de instalación apropiado (por ejemplo, webui-user.bat o webui.sh).
Configurar: Configure las variables de entorno o los argumentos de línea de comandos según sea necesario (por ejemplo, --xformers).
Ejecutar: Ejecute el script webui.bat o webui.sh para iniciar la interfaz.
Generar: Acceda a la interfaz web en su navegador y comience a crear imágenes utilizando varios modos y parámetros.
Mejorar: Utilice la pestaña 'Extras' para escalar y restaurar rostros, o explore scripts y extensiones personalizadas.
Entrenar: Utilice la pestaña 'Entrenamiento' para crear embeddings o hypernetworks personalizados.
Casos de uso de Stable Diffusion Web UI
- Generación de Arte con IA
- Edición y Mejora de Imágenes
- Diseño de Personajes y Conceptos
- Creación de Texturas
- Restauración Facial
- Entrenamiento y Personalización de Modelos
- Prototipado Visual
- Generación de Imágenes de Anime




