Articulo de referencia

Automático1111

"},"repo":{"wt":"{{URL|https://github.com/AUTOMATIC1111/stable-diffusion-webui}}"},"programming language":{"wt":"[[Python (programming language)|Python]]"},"license":{"wt":"[[GN...

AUTOMATIC1111 Stable Diffusion Web UI ( SD WebUI , A1111 o Automatic1111 [ 3 ] ) es un programa de inteligencia artificial generativa de código abierto que permite a los usuarios generar imágenes a partir de un texto . [ 4 ] Utiliza Stable Diffusion como modelo base para sus capacidades de imagen, junto con un amplio conjunto de extensiones y características para personalizar su resultado. [ 5 ]

Historia

SD WebUI fue lanzado en GitHub el 22 de agosto de 2022, por AUTOMATIC1111, [ 1 ] 1 mes después del lanzamiento inicial de Stable Diffusion. [ 6 ] En ese momento, Stable Diffusion solo podía ejecutarse a través de la línea de comandos . [ 5 ] SD WebUI rápidamente ganó popularidad y ha sido descrito como "la herramienta más popular para ejecutar modelos de difusión localmente". [ 4 ] [ 7 ] SD WebUI es una de las interfaces de usuario más populares para Stable Diffusion, junto con ComfyUI . [ 8 ] En febrero de 2024, ja:Gijutsu Hyoronsha publicó un libro sobre el uso de Stable Diffusion con SD WebUI en japonés. [ 9 ] [ 10 ] A julio de 2024, el proyecto tenía 136 000 estrellas en GitHub. [ 11 ]

Características

SD WebUI utiliza Gradio para su interfaz de usuario . [ 12 ] [ 13 ] [ 14 ] Cada parámetro en el programa Stable Diffusion se expone a través de una interfaz de usuario dentro de SD WebUI . SD WebUI contiene parámetros adicionales no incluidos en Stable Diffusion, como soporte para adaptaciones de rango bajo , ControlNet y autoencoders variacionales personalizados . [ 12 ] [ 13 ] [ 15 ] SD WebUI admite ponderación de indicaciones, generación basada en imagen a imagen, relleno de entrada , relleno de salida y escalado de imagen . [ 16 ] Admite más de 20 muestreadores , incluidos DDIM, Euler, Euler a, DPM++ 2M Karras y UniPC. [ 16 ] [ 17 ] También se utiliza para sus diversas optimizaciones sobre la base Stable Diffusion. [ 5 ]

Forja de interfaz web de difusión estable

Stable Diffusion WebUI Forge ( Forge ) es una bifurcación notable de SD WebUI iniciada por Lvmin Zhang, quien también es el creador de ControlNet y Fooocus . [ 18 ] [ 19 ] El objetivo inicial de Forge era mejorar el rendimiento y las características de SD WebUI con la intención de incorporar cambios a SD WebUI. [ 18 ] [ 19 ] Una de las optimizaciones de Forge permitió a los usuarios con poca VRAM generar imágenes más rápido en algunas versiones de Stable Diffusion. [ 18 ] Mejoró la velocidad de generación para usuarios con 8 GB y 6 GB de VRAM en un 30-45 % y un 60-75 %, respectivamente. [ 18 ] [ 19 ] Forge también incluye características adicionales como soporte para más muestreadores que el SD WebUI estándar. [ 20 ] Algunas de las optimizaciones de Forge fueron tomadas de ComfyUI , y otras fueron desarrolladas por el equipo de Forge. [ 19 ] En agosto de 2024, Forge agregó soporte para el modelo de difusión de flujo desarrollado por Black Forest Labs, que aún no es compatible con SD WebUI. [ 21 ]

Véase también

Referencias

  1. 1 2 AUTOMATIC1111 (22 de agosto de 2022). "Commit inicial" . github .{{cite web}}: CS1 maint: nombres numéricos: lista de autores ( enlace )
  2. AUTOMATIC1111 (15 de enero de 2023). "Agregar archivo de licencia" . github . Consultado el 11 de julio de 2024 .{{cite web}}: CS1 maint: nombres numéricos: lista de autores ( enlace )
  3. Brade, Stephen; Wang, Bryan; Sousa, Mauricio; Oore, Sageev; Grossman, Tovi (29 de octubre de 2023). «Promptify: Generación de texto a imagen mediante exploración interactiva de indicaciones con modelos de lenguaje extensos» . Actas del 36.º Simposio Anual de la ACM sobre Software y Tecnología de Interfaz de Usuario . Association for Computing Machinery. págs. 1-14 . arXiv : 2304.09337 . doi : 10.1145/3586183.3606725 . ISBN  979-8-4007-0132-0.
  4. 1 2 Mann, Tobias (29 de junio de 2024). "Una guía amigable para la generación de imágenes de IA local con difusión estable y Automatic1111" . The Register .
  5. 1 2 3 Lewis, Nick (16 de septiembre de 2022). "Cómo ejecutar Stable Diffusion localmente con una GUI en Windows" . How-To Geek . Recuperado el 11 de julio de 2024 .
  6. "Anuncio de SDXL 1.0" . Stability AI . 26 de julio de 2023.
  7. Zhu, Andrew (2024). Uso de difusión estable con Python: Aprovechamiento de Python para controlar y automatizar la generación de imágenes de IA de alta calidad mediante difusión estable . Packt Publishing. ISBN 978-1835084311Interfaz web de difusión estable de AUTO MATIC1111 : Esta podría ser la aplicación web más popular actualmente que permite a los usuarios generar imágenes y texto utilizando difusión estable. Proporciona una interfaz gráfica de usuario que facilita la experimentación con diferentes configuraciones y parámetros.
  8. Hu, Qihan; Xu, Zhenghui; Du, Peng; Zeng, Hao; Ma, Tongqing; Zhao, Youbing; Xie, Hao; Zhang, Peng; Liu, Shuting; Zang, Tongnian; Wang, Xuemei (2024). "CanFuUI: Una interfaz de usuario web centrada en lienzo para la generación iterativa de imágenes con modelos de difusión y ControlNet" . Contenido generado por IA . Communications in Computer and Information Science. Vol. 1946. Springer Nature Singapore. pp. 128–138 . doi : 10.1007/978-981-99-7587-7_11 . ISBN   978-981-99-7586-0Actualmente , las interfaces de usuario más populares para Stable Diffusion son Stable Diffusion WebUI y ComfyUI.
  9. 大崎, 顕; 水口, 瑛介 (23 de marzo de 2024).はじめてでもここまでできる Difusión estable画像生成[本格]活用ガイド(en japonés). ja:技術評論社. ISBN 978-4-297-14083-0.
  10. あわしろいくや (12 de junio de 2024). "第817回 参考書を片手にUbuntuでもStable Diffusion WebUIを動作させ、画像を生成する" . gihyo.jp (en japonés). ja:技術評論社.
  11. AUTOMATIC1111 (agosto de 2022). "Interfaz web de difusión estable" . github .{{cite web}}: CS1 maint: nombres numéricos: lista de autores ( enlace )
  12. 1 2 Wang, Chenghao; Chung, Jeanhun (30 de junio de 2023). "Investigación sobre la tecnología de generación de pintura por IA basada en [ Difusión estable ] " . Revista internacional de convergencia inteligente avanzada . 12 (2): 90– 95. doi : 10.7236/IJASC.2023.12.2.90 . La interfaz web de difusión estable es una interfaz de navegador basada en la biblioteca Gradio,
  13. 1 2 Kim, Seonuk; Ko, Taeyoung; Kwon, Yousang; Lee, Kyungho (9 de octubre de 2023). "Diseño de interfaces para la ingeniería de indicaciones de texto a imagen utilizando modelos de difusión estables: un enfoque de interacción humano-IA" . IASDR Conference Series . doi : 10.21606/iasdr.2023.448 . ISBN 978-1-912294-59-6.
  14. Hook, Steve (10 de enero de 2024). "Interfaz web de difusión estable: ejecute SDXL localmente con la interfaz gráfica de usuario AUTOMATIC1111" . PC Guide .
  15. Pocock, Kevin (16 de agosto de 2023). "Difusión estable: cómo usar VAE" . PC Guide . Consultado el 11 de julio de 2024 .
  16. 1 2 Phoenix, James; Taylor, Mike (2024). "Interfaz de usuario web AUTOMATIC1111". Ingeniería pronta para IA generativa: entradas a prueba de futuro para salidas de IA confiables a escala (Primera ed.). Pekín Boston: O'Reilly. ISBN  978-1098153434.
  17. Zhang, Jing; Jiang, Yan (junio de 2023). "Tecnología de transferencia de estilo de patrones de batik basada en aprendizaje profundo". Journal of Fiber Bioengineering and Informatics . 16 (1): 57– 67. doi : 10.3993/jfbim02171 .
  18. ^ 1 2 3 4西川 和久 (14 de febrero de 2024). "【西川和久の不定期コラム】 VRAMが少ないGPUで画像生成AIを諦めていた人に。「Stable Diffusion WebUI Forja」登場!" . Reloj de PC (en japonés).
  19. ^ 1 2 3 4新清士 (26 de febrero de 2024). "画像生成AI、安いPCでも高速に 衝撃の「Stable Diffusion WebUI Forge」 (1/4)" . ASCII.jp (en japonés).
  20. Horsey, Julian (14 de febrero de 2024). "Stable Diffusion WebUI Forge es hasta un 75 % más rápido que Automatic 1111 y ComfyUI" . Geeky Gadgets .
  21. 田口和裕 (18 de agosto de 2024). "話題の画像生成AI「FLUX.1」をStable Diffusion用の「WebUI Forge」で動かす(高速化も試してみました) (1/6)" . ASCII.jp (en japonés).