Pular para o conteúdo principal
Técnica

Mapa de Profundidade

Um mapa de profundidade é uma imagem na qual o brilho dos pixels representa a distância em relação à câmera — claro é próximo, escuro é distante. Modelos de IA usam mapas de profundidade para entender a estrutura 3D e controlar a geração espacialmente.

18 de junho de 2026

Mapa de Profundidade - AI image and video glossary preview from kublaro (depth map)
Mapa de Profundidade - AI image and video glossary preview from kublaro (depth map)

Um mapa de profundidade é uma imagem em tons de cinza na qual o brilho de cada pixel representa sua distância em relação à câmera — pixels claros estão próximos, pixels escuros estão distantes. Modelos de IA usam mapas de profundidade para entender a estrutura 3D em imagens 2D.

Como funciona

Um mapa de profundidade codifica a geometria 3D de uma cena em um formato de imagem 2D. O valor de cada pixel (de 0 a 255 em tons de cinza) corresponde ao quão distante aquele ponto está da câmera. Uma pessoa de pé próxima à câmera aparece clara; uma montanha distante aparece escura. Isso oferece aos modelos de IA uma compreensão espacial que as imagens RGB puras não possuem.

Por que isso importa na geração por IA

Mapas de profundidade permitem o controle espacial. Quando usado com ferramentas como o ControlNet, um mapa de profundidade pode guiar a geração de modo que o resultado siga a mesma estrutura 3D da entrada — uma pessoa em primeiro plano, um edifício no plano intermediário, o céu ao fundo. É assim que a IA consegue transformar uma foto em um estilo diferente enquanto preserva sua composição e perspectiva.

No vídeo com IA, os mapas de profundidade ajudam o modelo a entender quais partes da cena devem se mover de forma independente (objetos em primeiro plano) versus quais partes fazem parte do ambiente (fundo). Isso melhora a consistência temporal e o realismo do movimento.

No kublaro

O pipeline de geração do kublaro usa a compreensão de profundidade internamente para produzir imagens e vídeos mais coerentes espacialmente. Quando você usa imagem-para-imagem ou imagem-para-vídeo, o modelo infere a profundidade a partir da sua imagem de referência para manter a consistência estrutural no resultado.

Termos relacionados

Perguntas frequentes

O que é um mapa de profundidade na geração de imagens por IA?+

Um mapa de profundidade é uma imagem em tons de cinza na qual o brilho de cada pixel representa o quão distante aquele ponto está da câmera. Modelos de IA o utilizam para entender a estrutura 3D de uma imagem 2D, permitindo o controle espacial sobre a geração.

Como o ControlNet usa mapas de profundidade?+

O ControlNet pode receber um mapa de profundidade como entrada e usá-lo para guiar a geração — garantindo que a imagem gerada siga a mesma estrutura 3D do mapa de profundidade enquanto aplica um novo estilo, tema ou conteúdo.

Posso gerar um mapa de profundidade a partir de qualquer imagem?+

Sim. Modelos de IA de estimativa de profundidade conseguem inferir um mapa de profundidade a partir de qualquer imagem 2D. Esse mapa de profundidade pode então ser usado para guiar uma nova geração, criar efeitos 3D ou controlar o movimento de vídeo.

Crie com kublaro

Descreva qualquer coisa e gere imagens incríveis em segundos; depois dê movimento com os melhores modelos de vídeo com IA.

Relacionado

Próximos passos úteis