Veo , o Google Veo , es un modelo de conversión de texto a vídeo desarrollado por Google DeepMind y anunciado en mayo de 2024. Como modelo de IA generativa , crea vídeos a partir de las indicaciones del usuario . Veo 3, lanzado en mayo de 2025, también puede generar audio complementario.
Desarrollo
En mayo de 2024, se anunció en Google I/O 2024 un modelo de generación de video multimodal llamado Veo. [ 1 ] Google afirmó que podía generar videos de 1080p de más de un minuto de duración. [ 1 ] En diciembre de 2024, Google lanzó Veo 2, disponible a través de VideoFX. Admite la generación de video con resolución 4K y tiene una comprensión mejorada de la física. [ 2 ] En abril de 2025, Google anunció que Veo 2 estaba disponible para usuarios avanzados en la aplicación Gemini. [ 3 ]
En mayo de 2025, Google lanzó Veo 3, que no solo genera videos sino que también crea audio sincronizado —incluidos diálogos, efectos de sonido y ruido ambiental— para coincidir con las imágenes. [ 4 ] Google también anunció Flow , una herramienta de creación de video impulsada por Veo e Imagen . [ 5 ] [ 6 ] El CEO de Google DeepMind, Demis Hassabis, describió el lanzamiento como el momento en que la generación de video por IA dejó la era del cine mudo . [ 6 ] Esto fue renombrado como Google Flow en la presentación principal de Google I/O 2026, junto con el anuncio de Google Flow Music . [ 7 ]
Capacidades
Google Veo se puede adquirir mediante diferentes planes de suscripción y a través de los "créditos de IA" de Google. El software se puede ejecutar en dos consolas distintas: Google Gemini y Google Flow. Gemini está orientada a proyectos más cortos y rápidos, utilizando el modelo de chat de IA de Gemini, mientras que Google Flow, que es esencialmente un editor de vídeo , permite a los usuarios crear proyectos más largos con continuidad, utilizando los mismos personajes y actores. Los usuarios pueden crear un máximo de ocho segundos por clip. [ 8 ]
Según Gizmodo, los usuarios de Veo 3 dirigían al modelo para generar contenido de baja calidad, como entrevistas callejeras o vídeos de personas desempaquetando productos. [ 9 ] 404 Media informó que la herramienta tendía a repetir el mismo chiste en respuesta a diferentes indicaciones. [ 10 ]
Los comentaristas especularon que Google había entrenado el servicio con vídeos de YouTube [ 6 ] o publicaciones de Reddit . [ 10 ] Google no había declarado la fuente de su contenido de entrenamiento. [ 6 ]
En julio de 2025, Media Matters for America informó que se estaban subiendo a TikTok videos racistas y antisemitas generados con Veo 3. [ 11 ] [ 12 ] Ryan Whitwam de Ars Technica comentó: " En un mundo ideal, Veo 3 se negaría a crear estos videos, pero la vaguedad de la solicitud y la incapacidad de la IA para comprender las sutilezas de los estereotipos racistas (es decir, el uso de monos en lugar de humanos en algunos videos) hacen que sea fácil eludir las reglas". [ 12 ]
Véase también
- Sora (modelo de texto a vídeo)
- Seedance 2.0
- VideoPoet : modelo de conversión de texto a vídeo de Google.
- Máquina de sueños (modelo de texto a vídeo)
- LTX (modelo de IA)
Referencias
- 1 2 Wiggers, Kyle (14 de mayo de 2024). "Google Veo, un serio intento de generar video mediante IA, debuta en Google I/O 2024" . TechCrunch .
- ↑ "Google presenta Veo 2, un generador de vídeo con IA mejorado, para competir con Sora de OpenAI" . The Hindu . 17 de diciembre de 2024. ISSN 0971-751X . Consultado el 20 de diciembre de 2024 .
- ↑ Wiggers, Kyle (15 de abril de 2025). "El modelo de generación de vídeo Veo 2 de Google llega a Gemini" . TechCrunch . Archivado del original el 16 de abril de 2025. Consultado el 16 de abril de 2025 .
- ↑ "Google lanza Veo 3, un generador de vídeo con IA que incorpora audio" . CNBC . 2025-05-20 . Consultado el 2025-05-20 .
- ↑ Peters, Jay (20 de mayo de 2025). "Google tiene una nueva herramienta solo para hacer videos con IA" . The Verge . Archivado del original el 20 de mayo de 2025. Recuperado el 20 de mayo de 2025 .
- 1 2 3 4 Wiggers, Kyle (20 de mayo de 2025). "Veo 3 puede generar vídeos y bandas sonoras para acompañarlos" . TechCrunch .
- ↑ Schoon, Ben (19 de mayo de 2026). "Las herramientas de edición de vídeo y música de Google Flow AI tendrán aplicaciones dedicadas y actualizaciones para Omni" . 9to5Google . Archivado del original el 19 de mayo de 2026. Recuperado el 19 de mayo de 2026 .
- ↑ Caswell, Amanda (20 de mayo de 2025). "Google Veo 3 y Flow: El futuro de la producción cinematográfica con IA ya está aquí, y así es como funciona" . Tomsguide.com .
- ↑ Pero, James (22 de mayo de 2025). "Veo 3 de Google ya está creando deepfakes en todo el contenido más simple de YouTube" . Gizmodo . Archivado del original el 23 de mayo de 2025. Recuperado el 23 de mayo de 2025 .
- 1 2 Maiberg, Emanuel (21 de mayo de 2025). "¿Por qué al nuevo generador de vídeo con IA Veo 3 de Google le encanta este chiste de papá?" . 404 Media .
- ↑ Richards, Abbie (1 de julio de 2025). "Los videos racistas generados por IA son la nueva basura que acumula millones de visitas en TikTok" . Media Matters for America . Consultado el 4 de julio de 2025 .
- 1 2 Whitwam, Ryan (2 de julio de 2025). "TikTok se está inundando de vídeos racistas generados por IA mediante Veo 3 de Google" . Ars Technica . Consultado el 3 de julio de 2025 .
Enlaces externos
- Sitio web oficial
- Software 2024
- Aplicaciones de la inteligencia artificial
- Tecnología cinematográfica y de vídeo
- Google DeepMind
- Generación de texto a vídeo
- Procesamiento de vídeo
- IA generativa
- 2024 en inteligencia artificial