Descrição
A interface web do Stable Diffusion, desenvolvida por AUTOMATIC1111, fornece uma interface poderosa e amigável para interagir com modelos Stable Diffusion. Construída usando a biblioteca Gradio, ela simplifica o complexo processo de geração de imagens por IA, tornando-o acessível a um público mais amplo. A interface suporta os modos originais txt2img e img2img, juntamente com funcionalidades avançadas como outpainting, inpainting e color sketching.
As principais capacidades incluem a geração de matrizes de prompts, controle de atenção para partes específicas de prompts e processamento em loop para tarefas iterativas de img2img. O recurso de gráfico X/Y/Z permite a visualização de variações de imagem em diferentes parâmetros. Para usuários interessados em modelos de IA personalizados, a interface web suporta Textual Inversion, permitindo o uso de múltiplos embeddings personalizados. A aba 'Extras' integra ferramentas poderosas como GFPGAN e CodeFormer para restauração facial, e vários upscalers de redes neurais como RealESRGAN, ESRGAN, SwinIR, Swin2SR e LDSR.
Melhorando ainda mais sua utilidade, a interface oferece controle detalhado sobre métodos de amostragem, valores eta e configurações de ruído, com suporte para VRAM baixa (4GB e até 2GB relatados) e processamento interrompível. Os parâmetros de geração são salvos com as imagens, permitindo restauração fácil. Recursos avançados incluem suporte a tiling, pré-visualização ao vivo, prompts negativos, estilos para salvar prompts, variações, redimensionamento de seed, interrogador CLIP para adivinhação de prompts e edição de prompts durante a geração. Processamento em lote e um método alternativo de img2img também estão disponíveis.
A interface web suporta Highres Fix para geração de imagens de alta resolução com um clique, recarregamento de checkpoints em tempo real e um fusor de checkpoints. Ela também permite scripts e extensões personalizadas, incluindo Composable-Diffusion para geração multi-prompt e integração DeepDanbooru para marcação de anime. Os limites de tokens de prompt são removidos e xformers são suportados para aumentos significativos de velocidade. A aba de treinamento oferece opções para hypernetworks e embeddings, com capacidades de pré-processamento como corte e autotagging.
A instalação é simplificada com scripts de um clique para Windows e scripts de instalação automática para Linux e macOS. O projeto também suporta Stable Diffusion 2.0, Alt-Diffusion e Segmind Stable Diffusion, com opções para carregar checkpoints no formato safetensors e restrições de resolução facilitadas. A própria interface é personalizável, permitindo que os usuários reordenem elementos. O projeto é de código aberto sob a licença AGPL-3.0, promovendo contribuições e desenvolvimento da comunidade.
Recursos principais de Stable Diffusion Web UI
Geração de texto para imagem (txt2img)
Geração de imagem para imagem (img2img)
Capacidades de outpainting e inpainting
Controle avançado de prompt com atenção e ponderação
Gráfico X/Y/Z para visualização de parâmetros
Textual Inversion para embeddings personalizados
Restauração facial com GFPGAN e CodeFormer
Múltiplos upscalers de redes neurais (RealESRGAN, ESRGAN, SwinIR, etc.)
Suporte a VRAM baixa (4GB e 2GB)
Parâmetros de geração salvos com imagens
Suporte a tiling para texturas contínuas
Funcionalidade de prompt negativo
Estilos para salvar e aplicar trechos de prompt
Processamento em lote para múltiplos arquivos
Highres Fix para imagens de alta resolução com um clique
Ferramenta de fusão de checkpoints
Suporte a scripts e extensões personalizadas
Composable-Diffusion para geração multi-prompt
Integração DeepDanbooru para marcação de anime
xformers para aumentos significativos de velocidade
Aba de treinamento para hypernetworks e embeddings
Suporte ao formato de checkpoint Safetensors
Primeiros passos com Stable Diffusion Web UI
Clonar: Clone o repositório stable-diffusion-webui do GitHub.
Instalar dependências: Instale Python 3.10.6 e Git, depois execute o script de instalação apropriado (por exemplo, webui-user.bat ou webui.sh).
Configurar: Configure variáveis de ambiente ou argumentos de linha de comando conforme necessário (por exemplo, --xformers).
Executar: Execute o script webui.bat ou webui.sh para iniciar a interface.
Gerar: Acesse a interface web em seu navegador e comece a criar imagens usando vários modos e parâmetros.
Melhorar: Utilize a aba 'Extras' para upscaling e restauração facial, ou explore scripts e extensões personalizadas.
Treinar: Use a aba 'Treinamento' para criar embeddings ou hypernetworks personalizados.
Casos de uso de Stable Diffusion Web UI
- Geração de Arte por IA
- Edição e Aprimoramento de Imagens
- Design de Personagens e Conceitos
- Criação de Texturas
- Restauração Facial
- Treinamento e Personalização de Modelos
- Prototipagem Visual
- Geração de Imagens de Anime




