Veo
O Veo é o modelo de texto para vídeo do Google DeepMind, que produz clipes de vídeo em 1080p de alta qualidade a partir de descrições em texto, com qualidade cinematográfica e compreensão de física aprimorada.
18 de junho de 2026

O Veo é o modelo de IA de texto para vídeo do Google DeepMind, capaz de gerar clipes de vídeo em 1080p de alta qualidade a partir de prompts de texto, com forte coerência cinematográfica e compreensão de física.
Como funciona
O Veo usa uma arquitetura de modelo de difusão latente treinada com grandes volumes de dados de vídeo. Ele interpreta prompts de texto para gerar sequências de vídeo quadro a quadro, com atenção à consistência temporal, à simulação de física e à composição cinematográfica. A expertise do Google em IA multimodal — combinando compreensão de linguagem com geração visual — confere ao Veo forte interpretação de prompts e construção de cenas.
Por que importa
O Veo representa a entrada do Google na corrida de geração de vídeo por IA, ao lado do Sora da OpenAI e de outros modelos. Sua ênfase na compreensão de física — como os objetos devem se mover, interagir e responder a forças — aborda uma das principais fraquezas dos vídeos de IA mais antigos, em que a física impossível quebrava a imersão.
Principais recursos
- Saída em 1080p — resolução full HD adequada para a web e redes sociais.
- Estilos cinematográficos — suporta diversos estilos de filme, movimentos de câmera e configurações de iluminação por meio do prompt.
- Movimento com consciência de física — melhor compreensão de como objetos físicos se movem e interagem.
- Durações estendidas — clipes mais longos do que os primeiros modelos de vídeo por IA.
No kublaro
O kublaro monitora o cenário de vídeo por IA e seleciona os modelos mais adequados para cada tarefa de geração. Embora o Veo e o Sora sejam modelos notáveis, o pipeline do kublaro usa modelos disponíveis e comprovados, como o Kling 3, que entregam resultados excelentes para as durações de clipe e os estilos de que os criadores precisam hoje.
Termos relacionados
Perguntas frequentes
O que é o Google Veo?+
O Veo é o modelo de IA de texto para vídeo do Google DeepMind. Ele gera clipes de vídeo em 1080p a partir de prompts de texto e é conhecido pela qualidade cinematográfica, pela compreensão de física aprimorada e pelo suporte a diversos estilos visuais e cinematográficos.
Como o Veo se compara ao Sora?+
Tanto o Veo quanto o Sora são modelos de texto para vídeo de alta qualidade. O Veo enfatiza a compreensão de física e a saída em 1080p, enquanto o Sora é conhecido por durações de clipe mais longas. O kublaro usa os modelos mais adequados para entregar vídeo de qualidade, independentemente de qual modelo específico esteja à frente em determinado momento.
Em que resolução o Veo gera?+
O Veo gera vídeo em resolução 1080p (1920×1080), adequada para a maioria dos conteúdos da web e de redes sociais. Resoluções mais altas podem exigir upscaling.
Crie com kublaro
Descreva qualquer coisa e gere imagens incríveis em segundos; depois dê movimento com os melhores modelos de vídeo com IA.