Mis on Stable Diffusion
Mudel piltide genereerimiseks tekstikirjeldustest
Stable Diffusion on avatud lähtekoodiga masinõppemudel piltide genereerimiseks tekstikirjeldustest, mille on välja töötanud Stability AI.
Kuidas see töötab
- Tekstiviip teisendatakse manustuseks
- Mudel eemaldab järk-järgult müra juhuslikust pildist
- Juhitakse tekstikirjeldusega (CLIP)
- Tulemus on viipale vastav pilt
- Latent diffusion: töötab tihendatud ruumis
Võimalused
- Teksti-pildi genereerimine
- Pilditöötlus (inpainting)
- Stiiliülekanne (img2img)
- Resolutsiooni suurendamine
- Variatsioonide genereerimine
Eelised
- Avatud lähtekood
- Töötab tarbija GPU-del
- Kõrgekvaliteedilised pildid
- Aktiivne kogukond
- Palju laiendusi ja mudeleid
Ärirakendused
- Turundusmaterjalide loomine
- Disaini prototüüpimine
- Sotsiaalmeedia sisu genereerimine
- Kontseptkunst ja visualiseerimine
- Isikupärastatud pildid
Tööriistad
- Automatic1111 WebUI
- ComfyUI
- InvokeAI
- DiffusionBee (macOS)
- Draw Things (iOS)
Versioonid
- SD 1.5 — stabiilne baasversioon
- SD 2.0/2.1 — paranenud kvaliteet
- SDXL — kõrge resolutsioon (1024x1024)
- SD 3 — uusim arhitektuur