RODIN Diffusion ist ein Forschungs-Neuronales Netz eines Teams mit Microsoft-Bezug. Es nutzt einen diffusionsbasierten Ansatz, um 3D-Avatare aus einem Porträtfoto oder einer Textbeschreibung zu erzeugen. Die offizielle Website bietet keine öffentliche Oberfläche und keinen „Try it“-Button, daher ist es eher als Forschungsdemo denn als verbrauchsfertiger Dienst zu verstehen.
Wie es funktioniert
Das Modell erstellt eine 3D-Figur in mehreren Schritten:
Ein grober Durchlauf legt die grundlegende Körper- und Gesichtsstruktur fest
Eine Verfeinerung ergänzt Volumen, Texturen und Beleuchtung
Diese gestufte Pipeline hilft dabei, Aussehensdetails auch dann zu erhalten, wenn nur ein einzelnes Foto als Eingabe vorliegt.
Generierungsmodi und Bearbeitung
RODIN Diffusion unterstützt mehrere Arbeitsabläufe:
Rekonstruktion eines Avatars aus einem Foto
Generierung einer Figur aus Text-Prompts (z. B. Haarfarbe, Kleidungsdetails, Gesichtsmerkmale)
Bearbeitung einer bereits erzeugten Figur (z. B. Änderung der Frisur oder Hinzufügen von Accessoires)
Einschränkungen und Sicherheitshinweise
Es gibt keine offene öffentliche Version, daher können Sie kein Foto hochladen und über ein Online-Tool einen persönlichen 3D-Avatar erhalten. Das Projekt stellt nur Forschungsmaterialien und Beispiele bereit. Die Autoren weisen außerdem auf das Risiko eines Missbrauchs für Fälschungen hin und empfehlen, generierte Ergebnisse zu kennzeichnen, um Betrug und Fehlinformationen zu reduzieren.

