Veo
O modelo de vídeo cinematográfico da Google DeepMind

O Veo é o principal modelo de geração de vídeo da Google DeepMind, desenvolvido para produzir resultados cinematográficos de nível profissional. Converte descrições de texto e imagens em vídeos de alta fidelidade com áudio sincronizado — diálogos, som ambiente e música — gerado de uma só vez. O que distingue o Veo é a procura de coerência visual e linguagem cinematográfica: compreende movimentos de câmara, iluminação e composição de formas que os modelos anteriores não conseguiam, tornando-se uma referência de qualidade para avaliar outras ferramentas de vídeo com IA.
Destaques
- Síntese de áudio nativa: diálogos, som ambiente e música gerados com o vídeo num único pedido
- Imagens de nível profissional: composição cinematográfica, movimentos naturais de câmara e controlo da iluminação
- Instruções multimodais: descrições de texto ou imagens de referência, com controlo detalhado da câmara e do movimento
- Ampla disponibilidade: acessível através do Gemini e da interface de produção Flow
- Aperfeiçoamento iterativo: ajuste do enquadramento, movimento ou áudio sem voltar a gerar tudo desde o início
O Veo destina-se a criadores, cineastas e estúdios que procuram vídeo com qualidade de transmissão sem comprometer a coerência visual. A ferramenta dispõe de um nível gratuito limitado através do Gemini, com quotas superiores disponíveis; a utilização comercial e as funcionalidades premium exigem um plano pago através do Flow.
Comentários(0)
Entre para comentar