Automatic1111

AUTOMATIC1111 Stable Diffusion Web UI — свободное программное обеспечение с открытым исходным кодом на основе генеративного искусственного интеллекта, предназначенное для генерации изображений по текстовому описанию[2]. Программа использует модель Stable Diffusion в качестве основы и поддерживает большое количество расширений и функций для кастомизации результата[3]. Также обозначается как SD WebUI, A1111 или Automatic1111[4].

Общие сведения
AUTOMATIC1111 Stable Diffusion Web UI
Автор AUTOMATIC1111
Разработчики AUTOMATIC1111 и сообщество
Написана на Python
Первый выпуск 22 августа 2022
Последняя версия
Репозиторий github.com/AUTOMATIC1111…
Лицензия AGPL-3.0

История

SD WebUI был выложен на GitHub 22 августа 2022 года записью от AUTOMATIC1111[5], через месяц после первого выпуска Stable Diffusion[6]. На тот момент Stable Diffusion можно было запускать только через командную строку[3]. SD WebUI быстро стал популярным и был описан как «самый популярный инструмент для локального запуска диффузионных моделей»[2][7]. SD WebUI является одним из самых популярных графических интерфейсов для Stable Diffusion наряду с ComfyUI[8]. В феврале 2024 года издательство Gijutsu Hyoronsha (Япония) выпустило книгу о работе с Stable Diffusion в связке с SD WebUI на японском языке[9][10]. По состоянию на июль 2024 года проект имеет 136 000 звёзд на GitHub[11].

Возможности

SD WebUI использует Gradio в качестве фреймворка пользовательского интерфейса[12][13][14]. Все параметры, доступные в Stable Diffusion, представлены через интерфейс SD WebUI. Кроме того, SD WebUI добавляет собственные параметры, отсутствующие в оригинальном Stable Diffusion, в том числе поддержку Low-rank adaptation, ControlNet и пользовательских вариационных автоэнкодеров[12][13][15]. Поддерживается взвешивание текстовых промптов, генерация изображений по примеру (image-to-image), инпейтинг, outpainting и увеличение изображений[16]. Реализовано более 20 сэмплеров, включая DDIM, Euler, Euler a, DPM++ 2M Karras, UniPC и другие[16][17]. SD WebUI также ценится за многочисленные оптимизации по сравнению с базовой реализацией Stable Diffusion[3].

Stable Diffusion WebUI Forge

Stable Diffusion WebUI Forge (Forge) — заметный форк SD WebUI, разработанный Lvmin Zhang, который также создал ControlNet и Fooocus[18][19]. Изначальной целью Forge было повышение производительности и расширение возможностей SD WebUI с последующим внесением улучшений в основной проект[18][19]. Одна из оптимизаций Forge позволяет пользователям с малым объёмом VRAM ускорять генерацию изображений на некоторых версиях Stable Diffusion[18]. Например, для карт с 8 ГБ и 6 ГБ видеопамяти ускорение достигает 30–45 % и 60–75 % соответственно[18][19]. Forge также включает вспомогательные функции, не реализованные в стандартной SD WebUI, например поддержку большего числа сэмплеров[20]. Часть оптимизаций Forge была заимствована из ComfyUI, другая часть разработана собственной командой проекта[19]. В августе 2024 года в Forge добавлена поддержка диффузионной модели Flux от Black Forest Labs, пока отсутствующей в SD WebUI[21].

Примечания

  1. Release 1.10.1 — 2025.
  2. 1 2 Mann, Tobias A friendly guide to local AI image gen with Stable Diffusion and Automatic1111 (англ.). The Register (29 июня 2024). Дата обращения: 11 июля 2024. Архивировано 26 августа 2025 года.
  3. 1 2 3 Lewis, Nick How to Run Stable Diffusion Locally With a GUI on Windows (англ.). How-To Geek (16 сентября 2022). Дата обращения: 11 июля 2024. Архивировано 10 сентября 2025 года.
  4. Brade, Stephen. Promptify: Text-to-Image Generation through Interactive Prompt Exploration with Large Language Models // Proceedings of the 36th Annual ACM Symposium on User Interface Software and Technology / Stephen Brade, Bryan Wang, Mauricio Sousa … [и др.]. — Association for Computing Machinery, 2023-10-29. — P. 1–14. — ISBN 979-8-4007-0132-0. — doi:10.1145/3586183.3606725.
  5. Initial commit. github (22 августа 2022). Дата обращения: 11 июля 2024. Архивировано 4 февраля 2023 года.
  6. Announcing SDXL 1.0. Stability AI (26 июля 2023). Дата обращения: 11 июля 2024. Архивировано 6 октября 2025 года.
  7. Zhu, Andrew. Using Stable Diffusion with Python: Leverage Python to control and automate high-quality AI image generation using Stable Diffusion. — Packt Publishing, 2024. — «Stable Diffusion WebUI from AUTOMATIC1111: This might be the most popular web-based application currently that allows users to generate images and text using Stable Diffusion. It provides a GUI interface that makes it easy to experiment with different settings and parameters». — ISBN 978-1835084311.
  8. Hu, Qihan. CanFuUI: A Canvas-Centric Web User Interface for Iterative Image Generation with Diffusion Models and ControlNet // AI-generated Content : [англ.] / Qihan Hu, Zhenghui Xu, Peng Du … [et al.]. — Springer Nature Singapore, 2024. — Vol. 1946. — P. 128–138. — «Currently, the most popular user interfaces for Stable Diffusion are Stable Diffusion WebUI and ComfyUI.». — ISBN 978-981-99-7586-0. — doi:10.1007/978-981-99-7587-7_11.
  9. 大崎, 顕. はじめてでもここまでできる Stable Diffusion画像生成[本格]活用ガイド : [яп.] / 顕 大崎, 瑛介 水口. — 技術評論社, 2024-03-23年. — ISBN 978-4-297-14083-0.
  10. 第817回 参考書を片手にUbuntuでもStable Diffusion WebUIを動作させ、画像を生成する (яп.). gihyo.jp. 技術評論社 (12 июня 2024). Дата обращения: 11 июля 2024. Архивировано 4 сентября 2025 года.
  11. Stable Diffusion Web UI. github (август 2022). Дата обращения: 11 июля 2024. Архивировано 20 октября 2025 года.
  12. 1 2 Wang, Chenghao; Chung, Jeanhun (2023-06-30). “Research on AI Painting Generation Technology Based on the [Stable Diffusion]”. International Journal of Advanced Smart Convergence. 12 (2): 90—95. DOI:10.7236/IJASC.2023.12.2.90. Stable Diffusion Web UI is a browser interface based on the Gradio library,
  13. 1 2 Kim, Seonuk; Ko, Taeyoung; Kwon, Yousang; Lee, Kyungho (2023-10-09). “Designing interfaces for text-to-image prompt engineering using stable diffusion models: a human-AI interaction approach”. IASDR Conference Series. DOI:10.21606/iasdr.2023.448. ISBN 978-1-912294-59-6.
  14. Hook, Steve Stable Diffusion WebUI - Run SDXL locally with the AUTOMATIC1111 GUI. PC Guide (10 января 2024). Дата обращения: 11 июля 2024. Архивировано 19 августа 2025 года.
  15. Pocock, Kevin Stable Diffusion: How to Use VAE. PC Guide (16 августа 2023). Дата обращения: 11 июля 2024. Архивировано 18 августа 2025 года.
  16. 1 2 Phoenix, James. Prompt engineering for generative AI: future-proof inputs for reliable AI outputs at scale / James Phoenix, Mike Taylor. — First. — Beijing Boston : O'Reilly, 2024. — ISBN 978-1098153434.
  17. Zhang, Jing; Jiang, Yan (2023-06). “Style Transfer Technology of Batik Pattern Based on Deep Learning”. Journal of Fiber Bioengineering and Informatics. 16 (1): 57—67. DOI:10.3993/jfbim02171. Проверьте дату в |date= (справка на английском)
  18. 1 2 3 4 【西川和久の不定期コラム】 VRAMが少ないGPUで画像生成AIを諦めていた人に。「Stable Diffusion WebUI Forge」登場! (яп.). PC Watch (14 февраля 2024). Дата обращения: 11 июля 2024. Архивировано 7 октября 2025 года.
  19. 1 2 3 4 画像生成AI、安いPCでも高速に 衝撃の「Stable Diffusion WebUI Forge」 (1/4) (яп.). ASCII.jp (26 февраля 2024). Дата обращения: 11 июля 2024. Архивировано 24 сентября 2025 года.
  20. Horsey, Julian Stable Diffusion WebUI Forge up to 75% faster than Automatic 1111 and ComfyUI. Geeky Gadgets (14 февраля 2024). Дата обращения: 11 июля 2024. Архивировано 21 августа 2025 года.
  21. 話題の画像生成AI「FLUX.1」をStable Diffusion用の「WebUI Forge」で動かす(高速化も試してみました) (1/6) (яп.). ASCII.jp (18 августа 2024). Дата обращения: 11 июля 2024. Архивировано 8 августа 2025 года.