Pular para o conteúdo principal
Definição

Modelo de Difusão

Um modelo de difusão é um tipo de IA generativa que transforma ruído aleatório em uma imagem removendo esse ruído passo a passo, guiado por um prompt.

16 de junho de 2026

Modelo de Difusão - AI image and video glossary preview from kublaro (diffusion model)
Modelo de Difusão - AI image and video glossary preview from kublaro (diffusion model)

Um modelo de difusão é um sistema de IA generativa que cria imagens partindo de puro ruído aleatório e removendo-o progressivamente, passo a passo, até que surja uma imagem coerente.

Como funciona

Um modelo de difusão é treinado em duas direções. Durante o treinamento, ele pega imagens reais e adiciona ruído aleatório a elas em muitos pequenos incrementos, até que cada imagem se torne pura estática — esse é o processo "direto". O modelo aprende a prever e reverter cada um desses passos de adição de ruído.

Para gerar uma nova imagem, ele executa esse processo aprendido de trás para frente. Começa com um campo de ruído aleatório e, ao longo de dezenas de pequenos passos, prevê qual ruído remover em cada etapa. Um prompt de texto orienta cada passo, conduzindo a imagem emergente em direção às palavras que você digitou. Após o passo final, o ruído foi transformado em uma imagem limpa e original. A maioria dos sistemas modernos executa esse processo em um "espaço latente" comprimido por questões de velocidade e, depois, decodifica o resultado em pixels com resolução completa.

Por que isso importa

A difusão substituiu abordagens anteriores como as GANs como o método dominante para geração de imagens por IA, porque é mais estável de treinar e produz uma gama mais ampla de resultados detalhados e de alta qualidade. Ela segue os prompts com fidelidade, lida bem com cenas complexas e dá aos criadores um controle preciso por meio de configurações como o seed, a escala de CFG e o número de passos de remoção de ruído. O mesmo framework agora alimenta o vídeo por IA, onde a difusão é executada ao longo dos quadros para manter o movimento suave e consistente.

No kublaro

O kublaro usa geração baseada em difusão nos bastidores, então você nunca precisa lidar com a matemática — você descreve o que quer, escolhe um pacote de estilo e o modelo cuida da remoção de ruído. A partir daí, você pode animar imagens estáticas e transformá-las em movimento com o Kling 3 e exportar em até 4K, tudo a partir de prompts em linguagem simples.

Termos relacionados

Perguntas frequentes

O que é um modelo de difusão em termos simples?+

É uma IA que aprende a reverter um processo de adição de ruído. Ela começa com estática aleatória e, ao longo de muitos pequenos passos, vai limpando isso até obter uma imagem nítida que corresponde ao seu prompt.

Os modelos de difusão são iguais às GANs?+

Não. Ambos geram imagens, mas uma GAN usa duas redes que competem entre si em uma única passagem, enquanto um modelo de difusão refina a imagem gradualmente ao longo de muitos passos de remoção de ruído, o que tende a gerar resultados mais estáveis e variados.

Por que os modelos de difusão são tão populares para geração de imagens?+

Eles produzem imagens diversas e de alta qualidade e seguem os prompts de texto com fidelidade. A maioria das ferramentas modernas de texto para imagem, incluindo o Stable Diffusion, é baseada em difusão.

Os modelos de difusão também geram vídeo?+

Sim. A difusão de vídeo estende a mesma ideia ao longo dos quadros para que o movimento permaneça consistente, e é assim que os modelos modernos de vídeo por IA geram clipes.

Crie com kublaro

Descreva qualquer coisa e gere imagens incríveis em segundos; depois dê movimento com os melhores modelos de vídeo com IA.

Relacionado

Próximos passos úteis