Saltar al contenido principal
Técnica

Mapa de profundidad

Un mapa de profundidad es una imagen donde el brillo de los píxeles representa la distancia respecto a la cámara: lo brillante está cerca y lo oscuro está lejos. Los modelos de IA usan mapas de profundidad para entender la estructura 3D y controlar la generación de forma espacial.

18 de junio de 2026

Mapa de profundidad - AI image and video glossary preview from kublaro (depth map)
Mapa de profundidad - AI image and video glossary preview from kublaro (depth map)

Un mapa de profundidad es una imagen en escala de grises donde el brillo de cada píxel representa su distancia respecto a la cámara: los píxeles brillantes están cerca y los oscuros están lejos. Los modelos de IA usan mapas de profundidad para entender la estructura 3D en imágenes 2D.

Cómo funciona

Un mapa de profundidad codifica la geometría 3D de una escena en un formato de imagen 2D. El valor de cada píxel (de 0 a 255 en escala de grises) corresponde a qué tan lejos está ese punto respecto a la cámara. Una persona parada cerca de la cámara se ve brillante; una montaña distante se ve oscura. Esto le da a los modelos de IA una comprensión espacial de la que carecen las imágenes RGB puras.

Por qué importa en la generación con IA

Los mapas de profundidad permiten el control espacial. Cuando se usan con herramientas como ControlNet, un mapa de profundidad puede guiar la generación para que el resultado siga la misma estructura 3D que la entrada: una persona en primer plano, un edificio en segundo plano, el cielo al fondo. Así es como la IA puede transformar una foto en un estilo diferente mientras conserva su composición y perspectiva.

En el video con IA, los mapas de profundidad ayudan al modelo a entender qué partes de la escena deben moverse de forma independiente (los objetos en primer plano) frente a qué partes forman parte del entorno (el fondo). Esto mejora la consistencia temporal y el realismo del movimiento.

En kublaro

El pipeline de generación de kublaro usa la comprensión de la profundidad internamente para producir imágenes y videos más coherentes a nivel espacial. Cuando usas imagen a imagen o imagen a video, el modelo infiere la profundidad a partir de tu imagen de referencia para mantener la consistencia estructural en el resultado.

Términos relacionados

Preguntas frecuentes

¿Qué es un mapa de profundidad en la generación de imágenes con IA?+

Un mapa de profundidad es una imagen en escala de grises donde el brillo de cada píxel representa qué tan lejos está ese punto respecto a la cámara. Los modelos de IA lo usan para entender la estructura 3D de una imagen 2D, lo que permite un control espacial sobre la generación.

¿Cómo usa ControlNet los mapas de profundidad?+

ControlNet puede tomar un mapa de profundidad como entrada y usarlo para guiar la generación, asegurando que la imagen generada siga la misma estructura 3D que el mapa de profundidad mientras aplica un nuevo estilo, sujeto o contenido.

¿Puedo generar un mapa de profundidad a partir de cualquier imagen?+

Sí. Los modelos de IA de estimación de profundidad pueden inferir un mapa de profundidad a partir de cualquier imagen 2D. Ese mapa de profundidad puede usarse luego para guiar una nueva generación, crear efectos 3D o controlar el movimiento de un video.

Hazlo con kublaro

Describe cualquier cosa y genera imágenes increíbles en segundos; después dales movimiento con los mejores modelos de video con IA.

Relacionado

Siguientes pasos útiles