Google ha evolucionado en la generación de video mediante IA con el lanzamiento de Veo 3.1, una versión mejorada del modelo Veo 3 que incluye avances clave en sonido, edición y control visual. Esta nueva versión se incorpora a su editor Flow y extiende las habilidades creativas de los usuarios, garantizando resultados más realistas y acordes con las instrucciones proporcionadas.
Innovaciones clave y funciones destacadas
Entre las mejoras que introduce Veo 3.1 destacan:
- Calidad de audio mejorada: en la actualidad, las funciones de edición y conversión de imágenes a video incluyen sonido, efectos y ambientes que enriquecen la experiencia visual.
- Controles de edición granular: los usuarios tienen la capacidad de regular, con mayor exactitud, las sombras y la iluminación para lograr que los objetos añadidos se integren al estilo del video.
- Generación y extensión de escenas a partir de cuadros de inicio y fin: la función Scene Extension posibilita que los vídeos previos se extiendan con nuevas imágenes y audio, en tanto que Frames to Video genera transiciones entre las imágenes iniciales y finales.
- Compatibilidad con elementos en escena: se pueden añadir objetos al video de manera que tengan coherencia con el diseño visual. En breve también se permitirá la eliminación de elementos no deseados.
La integración de Veo 3.1 no se restringe a Flow, sino que también estará accesible por medio de Gemini App y de las APIs Vertex y Gemini para desarrolladores.
Desde su lanzamiento en mayo, los usuarios han creado más de 275 millones de videos utilizando esta herramienta.
Contexto y competencia
La aparición de Veo 3.1, se estudia como una reacción directa a competidores como Sora 2, de OpenAI. De acuerdo con fuentes como TechRadar, la versión reciente mejora la generación exacta en 1080p, aumenta el soporte para vídeos de mayor duración y mejora la uniformidad de escenas y personajes.
Además, Veo 3 ya había implementado efectos, diálogos y audio sincronizado como parte de sus habilidades innovadoras, y es parte del ecosistema de Google DeepMind para generar vídeos con IA.
Qué significa para creadores y mercado
Con Veo 3.1, Google hace más fuerte su compromiso de democratizar la creación de contenidos audiovisuales. Hoy en día, los creadores de diferentes niveles técnicos pueden producir clips sofisticados, ajustados y con sonido integrado sin requerir herramientas de edición convencionales.
Para los desarrolladores y las empresas, el hecho de que estén disponibles por medio de una API les permite tener la flexibilidad necesaria para integrar estas capacidades en sus propias plataformas y flujos laborales.


