Zum Hauptinhalt springen
AIDive
DE
Anmelden
RODIN Diffusion

RODIN Diffusion

Forschungsmodell, das 3D-Avatare aus einem Porträt oder Text erzeugt

0

Beschreibung

RODIN Diffusion ist ein Forschungs-Neuronales Netz eines Teams mit Microsoft-Bezug. Es nutzt einen diffusionsbasierten Ansatz, um 3D-Avatare aus einem Porträtfoto oder einer Textbeschreibung zu erzeugen. Die offizielle Website bietet keine öffentliche Oberfläche und keinen „Try it“-Button, daher ist es eher als Forschungsdemo denn als verbrauchsfertiger Dienst zu verstehen.

Wie es funktioniert

Das Modell erstellt eine 3D-Figur in mehreren Schritten:

Ein grober Durchlauf legt die grundlegende Körper- und Gesichtsstruktur fest

Eine Verfeinerung ergänzt Volumen, Texturen und Beleuchtung

Diese gestufte Pipeline hilft dabei, Aussehensdetails auch dann zu erhalten, wenn nur ein einzelnes Foto als Eingabe vorliegt.

Generierungsmodi und Bearbeitung

RODIN Diffusion unterstützt mehrere Arbeitsabläufe:

Rekonstruktion eines Avatars aus einem Foto

Generierung einer Figur aus Text-Prompts (z. B. Haarfarbe, Kleidungsdetails, Gesichtsmerkmale)

Bearbeitung einer bereits erzeugten Figur (z. B. Änderung der Frisur oder Hinzufügen von Accessoires)

Einschränkungen und Sicherheitshinweise

Es gibt keine offene öffentliche Version, daher können Sie kein Foto hochladen und über ein Online-Tool einen persönlichen 3D-Avatar erhalten. Das Projekt stellt nur Forschungsmaterialien und Beispiele bereit. Die Autoren weisen außerdem auf das Risiko eines Missbrauchs für Fälschungen hin und empfehlen, generierte Ergebnisse zu kennzeichnen, um Betrug und Fehlinformationen zu reduzieren.

0
0 Kommentare

Newsletter

Benachrichtigt werden, wenn neue KI-Tools hinzugefügt werden

Werde Teil der Community.