Pular para o conteúdo principal
Definição

Stable Diffusion

Stable Diffusion é um modelo de texto para imagem de código aberto que cria imagens removendo ruído gradualmente dentro de um espaço latente comprimido.

16 de junho de 2026

Stable Diffusion - AI image and video glossary preview from kublaro (stable diffusion)
Stable Diffusion - AI image and video glossary preview from kublaro (stable diffusion)

Stable Diffusion é um modelo de difusão latente de código aberto que gera imagens a partir de um prompt de texto removendo ruído repetidamente de uma representação comprimida até surgir uma imagem nítida.

Como funciona

O Stable Diffusion é construído sobre o processo de difusão: durante o treinamento, o modelo aprende como as imagens se dissolvem em ruído aleatório e, em seguida, aprende a reverter esse processo. Para gerar uma nova imagem, ele parte de puro ruído e remove um pouco dele a cada passo, orientado pelo seu prompt de texto, até formar uma imagem finalizada.

A grande inovação está em onde isso acontece. Em vez de trabalhar diretamente com milhões de pixels, o Stable Diffusion comprime as imagens em um espaço latente muito menor usando um autoencoder. Remover ruído nesse espaço compacto é drasticamente mais barato, e é por isso que o modelo consegue rodar em hardware de consumidor. Um codificador de texto converte seu prompt em números que o modelo pode seguir, e configurações como o seed, a escala CFG e o número de passos controlam o resultado. Um decodificador final transforma o latente já limpo de volta em uma imagem em resolução total.

Por que importa

O Stable Diffusion foi importante porque foi liberado de forma aberta. Essa abertura deu origem a todo um ecossistema: checkpoints personalizados, ajustes finos com LoRA, ControlNet e inúmeras ferramentas cresceram ao seu redor. Ele tornou a geração de imagens de alta qualidade acessível a pessoas sem grandes orçamentos de computação e estabeleceu muitos dos termos — espaço latente, remoção de ruído, escala CFG — que hoje são vocabulário padrão em todo o campo.

No kublaro

Você não precisa instalar nem ajustar nada disso para usar o kublaro. O kublaro encapsula modelos modernos de geração por trás de um estúdio limpo, para que você digite um prompt, escolha entre mais de 30 pacotes de estilo e obtenha uma imagem polida em segundos — e então a dê vida com vídeo Kling 3. A maquinaria de difusão roda por você; basta descrever o que você quer.

Termos relacionados

Perguntas frequentes

O que é o Stable Diffusion?+

É um modelo de IA de código aberto que transforma um prompt de texto em uma imagem. Ele funciona partindo de ruído aleatório e refinando-o passo a passo até surgir uma imagem coerente que corresponde ao prompt.

Por que é chamado de difusão 'latente'?+

Em vez de remover ruído de pixels em resolução total, o Stable Diffusion faz esse trabalho em uma representação comprimida menor chamada espaço latente. Isso torna sua execução muito mais rápida e leve do que a difusão no espaço de pixels.

O Stable Diffusion é gratuito para usar?+

Os pesos do modelo são liberados sob licenças abertas, então a tecnologia em si é gratuita. Executá-la ainda exige hardware capaz ou um serviço hospedado, e os termos de licença variam conforme a versão do modelo.

Como o Stable Diffusion se diferencia de outros modelos de imagem?+

Suas características definidoras são ser de código aberto e operar no espaço latente. Muitos outros modelos são fechados ou proprietários, enquanto o Stable Diffusion pode ser baixado, ajustado e estendido por qualquer pessoa.

Crie com kublaro

Descreva qualquer coisa e gere imagens incríveis em segundos; depois dê movimento com os melhores modelos de vídeo com IA.

Relacionado

Próximos passos úteis