00 · EM TRÊS MINUTOS
A resposta em três ideias
- 1O treino adiciona ruído e ensina a rede a estimá-lo.
- 2A geração começa em ruído novo e o remove em etapas.
- 3O texto orienta o caminho; não busca e cola uma única imagem de treino.
01 · APRENDER DESTRUINDO
Aprender destruindo
Imagens conhecidas recebem níveis controlados de ruído e a rede estima o ruído ou uma grandeza equivalente.
02 · INVERTER A SEQUÊNCIA
Inverter a sequência
Sem original para recuperar, a amostragem parte de ruído e forma bordas, regiões e texturas gradualmente.
Aprender destruindo
Imagens conhecidas recebem níveis controlados de ruído e a rede estima o ruído ou uma grandeza equivalente.
adicionar ruídoInverter a sequência
Sem original para recuperar, a amostragem parte de ruído e forma bordas, regiões e texturas gradualmente.
aprender remoçãoTexto orienta
Um codificador representa o prompt e favorece mudanças compatíveis; outra semente produz outra saída.
guiar por textoEspaço latente
Muitos sistemas processam uma representação comprimida e a decodificam em pixels no fim.
decodificar03 · TEXTO ORIENTA
Texto orienta
Um codificador representa o prompt e favorece mudanças compatíveis; outra semente produz outra saída.
04 · ESPAÇO LATENTE
Espaço latente
Muitos sistemas processam uma representação comprimida e a decodificam em pixels no fim.
05 · REALISMO NÃO É EVIDÊNCIA
Realismo não é evidência
A saída pode conter vieses, impossibilidades físicas ou memorização rara; aparência fotográfica não é documentação.
06 · FONTES E EVIDÊNCIAS
Fontes e evidências
As afirmações remetem a artigos fundamentais, padrões ou ao estudo primário da atualização.
- 01Denoising Diffusion Probabilistic ModelsESTUDO PRIMÁRIO ↗
Sustenta um mecanismo, uma medição ou um limite de evidência definido no artigo.
- 02High-Resolution Image Synthesis with Latent Diffusion ModelsESTUDO PRIMÁRIO ↗
Sustenta um mecanismo, uma medição ou um limite de evidência definido no artigo.
