RODIN Diffusion est un réseau neuronal de recherche associé à Microsoft. Il utilise une approche basée sur la diffusion pour générer des avatars 3D à partir d’une photo de portrait ou d’une description textuelle. Le site officiel ne propose pas d’interface publique ni de bouton « essayer », il s’agit donc plutôt d’une démonstration de recherche que d’un service prêt à l’emploi pour le grand public.
Comment ça fonctionne
Le modèle construit une figure 3D en plusieurs étapes :
Un premier passage qui établit la structure de base du corps et du visage
Une phase de raffinement qui ajoute le volume, les textures et l’éclairage
Ce pipeline par étapes aide à préserver les détails d’apparence même lorsque l’entrée est une simple photo.
Modes de génération et édition
RODIN Diffusion prend en charge plusieurs workflows :
Reconstruire un avatar à partir d’une seule photo
Générer une figure à partir d’invites textuelles (par exemple la couleur des cheveux, des détails vestimentaires ou des traits du visage)
Modifier une figure déjà générée (par exemple changer la coiffure ou ajouter des accessoires)
Limites et notes de sécurité
Il n’existe pas de version ouverte ou publique, vous ne pouvez donc pas téléverser une photo et recevoir un avatar 3D personnel via un outil en ligne. Le projet partage uniquement des éléments et des exemples de recherche. Les auteurs signalent aussi un risque d’usage détourné pour créer de faux contenus et recommandent d’étiqueter les résultats générés afin de réduire la fraude et la désinformation.

