Pular para o conteúdo principal
Modelo

Veo

O Veo é o modelo de texto para vídeo do Google DeepMind, que produz clipes de vídeo em 1080p de alta qualidade a partir de descrições em texto, com qualidade cinematográfica e compreensão de física aprimorada.

18 de junho de 2026

Veo - AI image and video glossary preview from kublaro (veo)
Veo - AI image and video glossary preview from kublaro (veo)

O Veo é o modelo de IA de texto para vídeo do Google DeepMind, capaz de gerar clipes de vídeo em 1080p de alta qualidade a partir de prompts de texto, com forte coerência cinematográfica e compreensão de física.

Como funciona

O Veo usa uma arquitetura de modelo de difusão latente treinada com grandes volumes de dados de vídeo. Ele interpreta prompts de texto para gerar sequências de vídeo quadro a quadro, com atenção à consistência temporal, à simulação de física e à composição cinematográfica. A expertise do Google em IA multimodal — combinando compreensão de linguagem com geração visual — confere ao Veo forte interpretação de prompts e construção de cenas.

Por que importa

O Veo representa a entrada do Google na corrida de geração de vídeo por IA, ao lado do Sora da OpenAI e de outros modelos. Sua ênfase na compreensão de física — como os objetos devem se mover, interagir e responder a forças — aborda uma das principais fraquezas dos vídeos de IA mais antigos, em que a física impossível quebrava a imersão.

Principais recursos

  • Saída em 1080p — resolução full HD adequada para a web e redes sociais.
  • Estilos cinematográficos — suporta diversos estilos de filme, movimentos de câmera e configurações de iluminação por meio do prompt.
  • Movimento com consciência de física — melhor compreensão de como objetos físicos se movem e interagem.
  • Durações estendidas — clipes mais longos do que os primeiros modelos de vídeo por IA.

No kublaro

O kublaro monitora o cenário de vídeo por IA e seleciona os modelos mais adequados para cada tarefa de geração. Embora o Veo e o Sora sejam modelos notáveis, o pipeline do kublaro usa modelos disponíveis e comprovados, como o Kling 3, que entregam resultados excelentes para as durações de clipe e os estilos de que os criadores precisam hoje.

Termos relacionados

Perguntas frequentes

O que é o Google Veo?+

O Veo é o modelo de IA de texto para vídeo do Google DeepMind. Ele gera clipes de vídeo em 1080p a partir de prompts de texto e é conhecido pela qualidade cinematográfica, pela compreensão de física aprimorada e pelo suporte a diversos estilos visuais e cinematográficos.

Como o Veo se compara ao Sora?+

Tanto o Veo quanto o Sora são modelos de texto para vídeo de alta qualidade. O Veo enfatiza a compreensão de física e a saída em 1080p, enquanto o Sora é conhecido por durações de clipe mais longas. O kublaro usa os modelos mais adequados para entregar vídeo de qualidade, independentemente de qual modelo específico esteja à frente em determinado momento.

Em que resolução o Veo gera?+

O Veo gera vídeo em resolução 1080p (1920×1080), adequada para a maioria dos conteúdos da web e de redes sociais. Resoluções mais altas podem exigir upscaling.

Crie com kublaro

Descreva qualquer coisa e gere imagens incríveis em segundos; depois dê movimento com os melhores modelos de vídeo com IA.

Relacionado

Próximos passos úteis