Saltar al contenido principal
Definición

Modelo de difusión

Un modelo de difusión es un tipo de IA generativa que convierte ruido aleatorio en una imagen eliminando ese ruido paso a paso, guiado por un prompt.

16 de junio de 2026

Modelo de difusión - AI image and video glossary preview from kublaro (diffusion model)
Modelo de difusión - AI image and video glossary preview from kublaro (diffusion model)

Un modelo de difusión es un sistema de IA generativa que crea imágenes partiendo de ruido puramente aleatorio y eliminándolo de forma progresiva, paso a paso, hasta que emerge una imagen coherente.

Cómo funciona

Un modelo de difusión se entrena en dos direcciones. Durante el entrenamiento, toma imágenes reales y les agrega ruido aleatorio en muchos incrementos pequeños hasta que cada imagen se convierte en estática pura: este es el proceso "hacia adelante". El modelo aprende a predecir y revertir cada uno de esos pasos de adición de ruido.

Para generar una imagen nueva, ejecuta ese proceso aprendido en sentido inverso. Comienza con un campo de ruido aleatorio y, a lo largo de decenas de pasos pequeños, predice qué ruido eliminar en cada etapa. Un prompt de texto guía cada paso, acercando la imagen emergente a las palabras que escribiste. Tras el paso final, el ruido se ha transformado en una imagen limpia y original. La mayoría de los sistemas modernos ejecutan este proceso en un "espacio latente" comprimido para ganar velocidad y luego decodifican el resultado en píxeles a resolución completa.

Por qué importa

La difusión reemplazó enfoques anteriores como las GAN como el método dominante para la generación de imágenes con IA, porque es más estable de entrenar y produce una gama más amplia de resultados detallados y de alta calidad. Sigue los prompts con fidelidad, maneja bien las escenas complejas y le da a quienes crean un control preciso mediante ajustes como la semilla, la escala CFG y el número de pasos de eliminación de ruido. El mismo marco ahora impulsa el video con IA, donde la difusión se ejecuta a través de los fotogramas para mantener el movimiento fluido y consistente.

En kublaro

kublaro usa la generación basada en difusión por debajo, así que nunca tienes que lidiar con las matemáticas: describes lo que quieres, eliges un paquete de estilo y el modelo se encarga de la eliminación de ruido. A partir de ahí puedes animar imágenes fijas para darles movimiento con Kling 3 y exportar hasta 4K, todo a partir de prompts en lenguaje natural.

Términos relacionados

Preguntas frecuentes

¿Qué es un modelo de difusión en términos simples?+

Es una IA que aprende a revertir un proceso de adición de ruido. Comienza con estática aleatoria y, a lo largo de muchos pasos pequeños, la limpia hasta obtener una imagen nítida que coincide con tu prompt.

¿Los modelos de difusión son lo mismo que las GAN?+

No. Ambos generan imágenes, pero una GAN usa dos redes que compiten entre sí en una sola pasada, mientras que un modelo de difusión refina una imagen de forma gradual a lo largo de muchos pasos de eliminación de ruido, lo que tiende a dar resultados más estables y variados.

¿Por qué son tan populares los modelos de difusión para generar imágenes?+

Producen imágenes diversas y de alta calidad, y siguen de cerca las indicaciones de texto. La mayoría de las herramientas modernas de texto a imagen, incluida Stable Diffusion, se basan en la difusión.

¿Los modelos de difusión también generan video?+

Sí. La difusión de video extiende la misma idea a través de los fotogramas para que el movimiento se mantenga consistente, y así es como los modelos modernos de video con IA generan clips.

Hazlo con kublaro

Describe cualquier cosa y genera imágenes increíbles en segundos; después dales movimiento con los mejores modelos de video con IA.

Relacionado

Siguientes pasos útiles