Stable Diffusion est un modèle d’IA open-source pour générer des images à partir de prompts texte. Lancé par Stability AI en 2022, il se distingue d’outils comme Midjourney et DALL-E par sa possibilité d’utilisation gratuite et d’installation locale sur votre propre ordinateur.
Fonctionnalités principales
Génération texte-vers-image avec plusieurs styles (dont photoréalisme, anime et art numérique)
Inpainting pour remplacer ou modifier des objets dans une image existante
Outpainting pour étendre une image et remplir automatiquement l’arrière-plan
ControlNet pour une génération guidée par des croquis et des références 3D
LoRA, des « micro-modèles » pour une stylisation rapide sans forte utilisation de VRAM
Verrouillage du seed pour créer des variantes contrôlées d’une même image
Stable Diffusion prend en charge les prompts en russe ainsi qu’en anglais. La version 3 améliore le niveau de détail et restitue plus fidèlement le texte dans les images.
Utilisation et installation
Vous pouvez utiliser Stable Diffusion en ligne ou en local. Une installation locale nécessite généralement un GPU avec 4 Go de VRAM ou plus et environ 15 Go d’espace disque libre.
En ligne : DreamStudio (payant, à partir de 10 $ pour 1 000 crédits), Hugging Face (gratuit mais plus lent), Playground AI (illimité avec filigranes)
En local : Automatic1111 (interface web populaire), ComfyUI (workflow basé sur des nœuds, souvent privilégié pour AMD), Easy Diffusion 3.0 (installateur simplifié)
Notes techniques
Entraîné sur 5 milliards d’images
Fonctionne sur les GPU NVIDIA, AMD et Intel
Génère une image en environ 5 à 30 secondes
Prend en charge une résolution allant jusqu’à 2048×2048
500 modifications communautaires
Autorise l’utilisation commerciale

