O que é Stable Diffusion
Modelo para gerar imagens a partir de descrições de texto
Stable Diffusion é um modelo de aprendizado de máquina de código aberto para gerar imagens a partir de descrições de texto, desenvolvido pela Stability AI.
Como Funciona
- O prompt de texto é convertido em embedding
- O modelo remove gradualmente o ruído de uma imagem aleatória
- Guiado pela descrição de texto (CLIP)
- O resultado é uma imagem correspondente ao prompt
- Difusão latente: trabalha em espaço comprimido
Capacidades
- Geração de texto para imagem
- Edição de imagens (inpainting)
- Transferência de estilo (img2img)
- Aumento de resolução
- Geração de variações
Vantagens
- Código aberto
- Funciona em GPUs de consumo
- Imagens de alta qualidade
- Comunidade ativa
- Muitas extensões e modelos
Aplicações Empresariais
- Criação de materiais de marketing
- Prototipagem de design
- Geração de conteúdo para redes sociais
- Arte conceitual e visualização
- Imagens personalizadas
Ferramentas
- Automatic1111 WebUI
- ComfyUI
- InvokeAI
- DiffusionBee (macOS)
- Draw Things (iOS)
Versões
- SD 1.5 — versão base estável
- SD 2.0/2.1 — qualidade melhorada
- SDXL — alta resolução (1024x1024)
- SD 3 — arquitetura mais recente