Ir para o conteúdo principal
AIDive
PT
Entrar
RODIN Diffusion

RODIN Diffusion

Modelo de pesquisa que gera avatares 3D a partir de um retrato ou de texto

0

Descrição

RODIN Diffusion é uma rede neural de pesquisa de uma equipe associada à Microsoft. Ela usa uma abordagem baseada em difusão para gerar avatares 3D a partir de uma foto de retrato ou de uma descrição em texto. O site oficial não oferece uma interface pública nem um botão de “testar”, então é melhor entendê-lo como uma demonstração de pesquisa, e não como um serviço pronto para uso por consumidores.

Como funciona

O modelo constrói uma figura 3D em várias etapas:

Uma passagem inicial que estabelece a estrutura principal do corpo e do rosto

Um refinamento que adiciona volume, texturas e iluminação

Esse pipeline em etapas ajuda a preservar detalhes da aparência mesmo quando a entrada é apenas uma única foto.

Modos de geração e edição

RODIN Diffusion oferece vários fluxos de trabalho:

Reconstrução de um avatar a partir de uma foto

Geração de uma figura a partir de prompts de texto (por exemplo, cor do cabelo, detalhes da roupa, traços faciais)

Edição de uma figura já gerada (por exemplo, mudar o penteado ou adicionar acessórios)

Limitações e observações de segurança

Não existe uma versão aberta ou pública disponível, então não é possível enviar uma foto e receber um avatar 3D pessoal por meio de uma ferramenta online. O projeto compartilha apenas materiais de pesquisa e exemplos. Os autores também observam o risco de uso indevido para fraudes e recomendam rotular os resultados gerados para reduzir golpes e desinformação.

0
0 comentário

Newsletter

Receba notificações quando novas ferramentas de IA forem adicionadas

Junte-se à comunidade.