Описание
Stable Diffusion web UI, разработанный AUTOMATIC1111, предоставляет мощный и удобный интерфейс для взаимодействия с моделями Stable Diffusion. Созданный с использованием библиотеки Gradio, он упрощает сложный процесс генерации изображений с помощью ИИ, делая его доступным для более широкой аудитории. Интерфейс поддерживает оригинальные режимы txt2img и img2img, а также расширенные функции, такие как outpainting, inpainting и color sketching.
Ключевые возможности включают генерацию матрицы промптов, контроль внимания к определенным частям промптов и обработку обратной связи для итеративных задач img2img. Функция X/Y/Z plot позволяет визуализировать вариации изображений по различным параметрам. Для пользователей, интересующихся пользовательскими моделями ИИ, веб-интерфейс поддерживает Textual Inversion, позволяя использовать несколько пользовательских эмбеддингов. Вкладка 'Extras' интегрирует мощные инструменты, такие как GFPGAN и CodeFormer для восстановления лиц, а также различные нейросетевые апскейлеры, такие как RealESRGAN, ESRGAN, SwinIR, Swin2SR и LDSR.
Дополнительно повышая свою полезность, интерфейс предлагает детальный контроль над методами сэмплирования, значениями eta и настройками шума, с поддержкой низкого VRAM (сообщается о 4 ГБ и даже 2 ГБ) и прерываемой обработкой. Параметры генерации сохраняются вместе с изображениями, что позволяет легко их восстановить. Расширенные функции включают поддержку тайлинга, предварительный просмотр в реальном времени, негативные промпты, стили для сохранения промптов, вариации, изменение размера сида, CLIP interrogator для угадывания промптов и редактирование промптов в процессе генерации. Также доступны пакетная обработка и альтернативный метод img2img.
Веб-интерфейс поддерживает Highres Fix для генерации изображений высокого разрешения в один клик, динамическую перезагрузку чекпоинтов и слияние чекпоинтов. Он также позволяет использовать пользовательские скрипты и расширения, включая Composable-Diffusion для генерации с несколькими промптами и интеграцию DeepDanbooru для тегирования аниме. Ограничения на токены промптов сняты, и поддерживаются xformers для значительного увеличения скорости. Вкладка обучения предлагает опции для гиперсетей и эмбеддингов, с возможностями предварительной обработки, такими как обрезка и автотегирование.
Установка упрощена с помощью скриптов установки в один клик для Windows и автоматических скриптов установки для Linux и macOS. Проект также поддерживает Stable Diffusion 2.0, Alt-Diffusion и Segmind Stable Diffusion, с опциями для загрузки чекпоинтов в формате safetensors и снятием ограничений на разрешение. Сам интерфейс настраивается, позволяя пользователям изменять порядок элементов. Проект является открытым исходным кодом под лицензией AGPL-3.0, способствуя вкладу сообщества и развитию.
Основные функции Stable Diffusion Web UI
Генерация изображений из текста (txt2img)
Генерация изображений из изображений (img2img)
Возможности Outpainting и Inpainting
Расширенный контроль промптов с вниманием и весом
X/Y/Z plot для визуализации параметров
Textual Inversion для пользовательских эмбеддингов
Восстановление лиц с помощью GFPGAN и CodeFormer
Множество нейросетевых апскейлеров (RealESRGAN, ESRGAN, SwinIR и др.)
Поддержка низкого VRAM (4 ГБ и 2 ГБ)
Параметры генерации сохраняются с изображениями
Поддержка тайлинга для бесшовных текстур
Функциональность негативных промптов
Стили для сохранения и применения фрагментов промптов
Пакетная обработка для нескольких файлов
Highres Fix для получения изображений высокого разрешения в один клик
Инструмент слияния чекпоинтов
Поддержка пользовательских скриптов и расширений
Composable-Diffusion для генерации с несколькими промптами
Интеграция DeepDanbooru для тегирования аниме
xformers для значительного увеличения скорости
Вкладка обучения для гиперсетей и эмбеддингов
Поддержка формата чекпоинтов Safetensors
Начало работы с Stable Diffusion Web UI
Клонирование: Клонируйте репозиторий stable-diffusion-webui с GitHub.
Установка зависимостей: Установите Python 3.10.6 и Git, затем запустите соответствующий скрипт установки (например, webui-user.bat или webui.sh).
Конфигурация: Настройте переменные окружения или аргументы командной строки по мере необходимости (например, --xformers).
Запуск: Запустите скрипт webui.bat или webui.sh для запуска интерфейса.
Генерация: Откройте веб-интерфейс в браузере и начните создавать изображения, используя различные режимы и параметры.
Улучшение: Используйте вкладку 'Extras' для апскейлинга и восстановления лиц или изучите пользовательские скрипты и расширения.
Обучение: Используйте вкладку 'Training' для создания пользовательских эмбеддингов или гиперсетей.
Варианты использования Stable Diffusion Web UI
- Генерация AI-искусства
- Редактирование и улучшение изображений
- Дизайн персонажей и концепций
- Создание текстур
- Восстановление лиц
- Обучение и настройка моделей
- Визуальное прототипирование
- Генерация аниме-изображений




