Uma arquitetura de IA generativa que cria imagens aprendendo a reverter um processo gradual de adição de ruído.
O que é um modelo de difusão? ⏎ ⏎ Um modelo de difusão é uma arquitetura de IA generativa que cria imagens aprendendo a reverter um processo de adição de ruído. Durante o treino, as imagens são progressivamente destruídas com ruído aleatório e o modelo aprende a desfazer cada etapa. No momento da geração, ele parte do puro ruído e remove-o passo a passo até criar uma nova imagem, guiado por um comando de texto, uma imagem de referência, ou ambos. ⏎ ⏎ Os modelos de difusão são a base da maioria dos geradores de imagem de ponta, incluindo os sistemas de transferência de peças de roupa utilizados nos provadores virtuais baseados em imagens. ⏎ ⏎
Um modelo de difusão a remover o ruído desde o ruído aleatório até uma imagem finalizada ⏎ ⏎ ## Como funciona ⏎ ⏎ 1. Processo de avanço (treino): adiciona-se ruído a uma imagem real em pequenas etapas até restar apenas estática. ⏎ 2. Processo inverso aprendido: o modelo é treinado para prever o estado anterior, com menos ruído, em cada etapa. ⏎ 3. Geração: começando com ruído aleatório, a remoção do ruído aprendida é aplicada repetidamente (geralmente entre 20 a 50 passos) até surgir uma imagem coerente. ⏎ 4. Condicionamento: em cada passo, o modelo pode ser orientado por dados como a imagem de uma peça de roupa, a postura do corpo ou uma máscara da região a repintar. ⏎ ⏎ ## O seu papel no provador virtual ⏎ ⏎ O condicionamento é o que transforma um gerador de imagens geral num motor de provador virtual: dada a foto de uma pessoa, a foto de uma peça de roupa e a máscara dessa roupa, o modelo volta a gerar apenas a região mascarada (ver repintura de imagens) com texturas de tecido, vincos e iluminação consistentes com a foto original. ⏎ ⏎ A contrapartida é a velocidade: a geração demora segundos e exige processamento de GPU, sendo essa a razão pela qual o provador baseado em difusão produz imagens estáticas em vez de sobreposições de vídeo em tempo real. ⏎ ⏎
FAQ
Dúvidas respondidas.
⏎ Por que razão os modelos de difusão substituíram as GANs nos provadores virtuais?↓
⏎ As pesquisas anteriores em provadores virtuais usavam GANs, mas os modelos de difusão revelaram-se mais estáveis de treinar, mais fáceis de controlar através do condicionamento e melhores a reproduzir texturas finas. Tudo isto é crucial quando se trata de roupa. ⏎