Qué es Stable Diffusion
Modelo para generar imágenes desde descripciones de texto
Stable Diffusion es un modelo de aprendizaje automático de código abierto para generar imágenes a partir de descripciones de texto, desarrollado por Stability AI.
Cómo Funciona
- El prompt de texto se convierte en embedding
- El modelo elimina gradualmente el ruido de una imagen aleatoria
- Guiado por la descripción de texto (CLIP)
- El resultado es una imagen que coincide con el prompt
- Difusión latente: trabaja en espacio comprimido
Capacidades
- Generación de texto a imagen
- Edición de imágenes (inpainting)
- Transferencia de estilo (img2img)
- Aumento de resolución
- Generación de variaciones
Ventajas
- Código abierto
- Funciona en GPUs de consumo
- Imágenes de alta calidad
- Comunidad activa
- Muchas extensiones y modelos
Aplicaciones Empresariales
- Creación de materiales de marketing
- Prototipado de diseño
- Generación de contenido para redes sociales
- Arte conceptual y visualización
- Imágenes personalizadas
Herramientas
- Automatic1111 WebUI
- ComfyUI
- InvokeAI
- DiffusionBee (macOS)
- Draw Things (iOS)
Versiones
- SD 1.5 — versión base estable
- SD 2.0/2.1 — calidad mejorada
- SDXL — alta resolución (1024x1024)
- SD 3 — arquitectura más reciente