Veo
El modelo de vídeo cinematográfico de Google DeepMind

Veo es el modelo insignia de generación de vídeo de Google DeepMind, diseñado para producir resultados cinematográficos de calidad profesional. Convierte descripciones de texto e imágenes en vídeos de alta fidelidad con audio sincronizado —diálogos, sonido ambiente y música— generado en una sola ejecución. Veo destaca por su búsqueda de coherencia visual y su comprensión del lenguaje cinematográfico: interpreta movimientos de cámara, iluminación y composición de formas que los modelos anteriores no lograban, lo que lo convierte en una referencia de calidad para evaluar otras herramientas de vídeo con IA.
Aspectos destacados
- Síntesis de audio nativa: genera diálogos, sonido ambiente y música junto con el vídeo en una sola solicitud
- Imágenes de calidad profesional, con composición cinematográfica, movimientos de cámara naturales y control de la iluminación
- Instrucciones multimodales mediante descripciones de texto o imágenes iniciales, con control detallado de la cámara y el movimiento
- Amplia disponibilidad mediante Gemini y la interfaz cinematográfica Flow
- Perfeccionamiento iterativo para ajustar el encuadre, el movimiento o el audio sin regenerar todo desde cero
Veo está dirigido a creadores, cineastas y estudios que buscan vídeo con calidad de emisión sin renunciar a la coherencia visual. Se ofrece mediante Gemini con un nivel gratuito limitado y cuotas superiores disponibles; el uso comercial y las funciones prémium requieren un plan de pago a través de Flow.
Herramientas similares
Ver alternativas →Imagen
FreemiumConvierte texto en imágenes de alta calidad al instante
Gemini
FreemiumEl asistente de Google, integrado con Search, Gmail y Docs
Google AI Studio
FreemiumEl entorno de Google para crear con modelos Gemini
Comentarios(0)
Inicia sesión para comentar