RODIN Diffusion é uma rede neural de pesquisa de uma equipe associada à Microsoft. Ela usa uma abordagem baseada em difusão para gerar avatares 3D a partir de uma foto de retrato ou de uma descrição em texto. O site oficial não oferece uma interface pública nem um botão de “testar”, então é melhor entendê-lo como uma demonstração de pesquisa, e não como um serviço pronto para uso por consumidores.
Como funciona
O modelo constrói uma figura 3D em várias etapas:
Uma passagem inicial que estabelece a estrutura principal do corpo e do rosto
Um refinamento que adiciona volume, texturas e iluminação
Esse pipeline em etapas ajuda a preservar detalhes da aparência mesmo quando a entrada é apenas uma única foto.
Modos de geração e edição
RODIN Diffusion oferece vários fluxos de trabalho:
Reconstrução de um avatar a partir de uma foto
Geração de uma figura a partir de prompts de texto (por exemplo, cor do cabelo, detalhes da roupa, traços faciais)
Edição de uma figura já gerada (por exemplo, mudar o penteado ou adicionar acessórios)
Limitações e observações de segurança
Não existe uma versão aberta ou pública disponível, então não é possível enviar uma foto e receber um avatar 3D pessoal por meio de uma ferramenta online. O projeto compartilha apenas materiais de pesquisa e exemplos. Os autores também observam o risco de uso indevido para fraudes e recomendam rotular os resultados gerados para reduzir golpes e desinformação.

