Un modelo de texto a video es una forma de inteligencia artificial generativa que utiliza una descripción en lenguaje natural como entrada para producir un video relevante para el texto de entrada. [ 1 ] Los avances durante la década de 2020 en la generación de videos de alta calidad condicionados por texto han sido impulsados en gran medida por el desarrollo de modelos de difusión de video . [ 2 ]
Modelos
Hay diferentes modelos, incluidos modelos de código abierto . Entrada en idioma chino [ 3 ] CogVideo es el primer modelo de texto a video "de 9.4 mil millones de parámetros" que se desarrolló, con su versión demo de códigos de código abierto presentada por primera vez en GitHub en 2022. [ 4 ] Ese año, Meta Platforms lanzó un modelo parcial de texto a video llamado "Make-A-Video", [ 5 ] [ 6 ] [ 7 ] y Google Brain (más tarde Google DeepMind ) presentó Imagen Video, un modelo de texto a video con U-Net 3D . [ 8 ] [ 6 ] [ 9 ] [ 10 ] [ 11 ]
2023
En febrero de 2023, Runway lanzó Gen-1 y Gen-2, entre los primeros modelos de conversión de texto a vídeo y de vídeo a vídeo disponibles comercialmente y accesibles al público a través de una interfaz web. Gen-1, lanzado inicialmente como un modelo de vídeo a vídeo, permitía a los usuarios transformar grabaciones de vídeo existentes mediante texto o imágenes. [ 12 ] Gen-2, presentado en marzo de 2023 y disponible públicamente en junio de 2023, añadió capacidades de conversión de texto a vídeo, permitiendo a los usuarios generar vídeos a partir únicamente de texto. [ 13 ]
En marzo de 2023, se publicó un artículo de investigación titulado "VideoFusion: Modelos de difusión descompuestos para la generación de vídeo de alta calidad", que presentaba un enfoque novedoso para la generación de vídeo. El modelo VideoFusion descompone el proceso de difusión en dos componentes: ruido base y ruido residual, que se comparten entre fotogramas para garantizar la coherencia temporal. Al utilizar un modelo de difusión de imagen preentrenado como generador base, el modelo generó de manera eficiente vídeos coherentes y de alta calidad. El ajuste fino del modelo preentrenado con datos de vídeo abordó la brecha de dominio entre los datos de imagen y vídeo, mejorando la capacidad del modelo para producir secuencias de vídeo realistas y consistentes. [ 14 ] En el mismo mes, Adobe presentó Firefly AI como parte de sus funciones. [ 15 ]
2024
En enero de 2024, Google anunció el desarrollo de un modelo de texto a video llamado Lumiere que se anticipa que integrará capacidades avanzadas de edición de video. [ 16 ] Matthias Niessner y Lourdes Agapito en la empresa de IA Synthesia trabajan en el desarrollo de técnicas de renderizado neuronal 3D que pueden sintetizar video realista utilizando representaciones neuronales 2D y 3D de forma, apariencia y movimiento para la síntesis de video controlable de avatares. [ 17 ] En junio de 2024, Luma Labs lanzó su herramienta de video Dream Machine . [ 18 ] [ 19 ] Ese mismo mes, [ 20 ] Kuaishou extendió su modelo de texto a video Kling AI a usuarios internacionales. En julio de 2024, ByteDance , propietario de TikTok , lanzó Jimeng AI en China, a través de su subsidiaria, Faceu Technology. [ 21 ] En septiembre de 2024, la empresa china de IA MiniMax presentó su modelo video-01, uniéndose a otras empresas de modelos de IA establecidas como Zhipu AI , Baichuan y Moonshot AI , que contribuyen a la participación de China en la tecnología de IA. [ 22 ] En diciembre de 2024, Lightricks lanzó LTX Video como un modelo de código abierto. [ 23 ]
2025
Los enfoques alternativos para los modelos de texto a video incluyen [ 24 ] Phenaki de Google, Hour One, Colossyan , [ 3 ] Gen-3 Alpha de Runway , [ 25 ] [ 26 ] y Sora de OpenAI , [ 27 ] [ 28 ] Han surgido varios modelos adicionales de texto a video, como Plug-and-Play, Text2LIVE y TuneAVideo. [ 29 ] El desarrollador de FLUX.1, Black Forest Labs, ha anunciado su modelo de texto a video SOTA. [ 30 ] Google se estaba preparando para lanzar una herramienta de generación de video llamada Veo para YouTube Shorts en 2025. [ 31 ] En mayo de 2025, Google lanzó la iteración Veo 3 del modelo. Se destacó por sus impresionantes capacidades de generación de audio, que eran una limitación anterior para los modelos de texto a video. [ 32 ] En julio de 2025, Lightricks lanzó una actualización de LTX Video capaz de generar clips de hasta 60 segundos, [ 33 ] [ 34 ] y en octubre de 2025 lanzó LTX-2, con capacidades de audio integradas. [ 35 ]
2026
En febrero de 2026, ByteDance lanzó Seedance 2.0 , que se destacó por su impresionante generación realista, control de movimiento y cámara y generación de 15 segundos, [ 36 ] sin embargo, el modelo enfrentó grandes críticas de la Motion Picture Association por infracción de derechos de autor. [ 37 ] Después de ver un clip viral de una pelea entre los actores Brad Pitt y Tom Cruise , Rhett Reese , quien es el coguionista de Deadpool & Wolverine y Zombieland anunció que en las redes sociales "Odio decirlo. Probablemente se acabó para nosotros", [ 38 ] afirmando además que "En muy poco tiempo, una persona podrá sentarse frente a una computadora y crear una película indistinguible de lo que Hollywood estrena ahora". [ 37 ]
En julio de 2026, ByteDance lanzó Seedance 2.5, un nuevo SOTA para modelos de texto a video, capaz de generar videos nativos de 30 segundos con 50 referencias multimodales como entrada. Entre sus características principales se incluyen videos 4K y edición local; por ejemplo, en lugar de regenerar un clip completo de 30 segundos si un detalle (como el color del cabello de un personaje) es incorrecto, los usuarios ahora pueden modificar áreas específicas dentro de la escena para corregirlo. Esto evita la pérdida de las interpretaciones, expresiones faciales o iluminación preferidas establecidas en la toma original. [ 39 ] Seedance 2.5 también incluye un modo beta de video largo que extiende los clips a 3 minutos. [ 40 ]
Arquitectura y formación
Existen diversas arquitecturas que se han utilizado para crear modelos de conversión de texto a vídeo. Al igual que los modelos de conversión de texto a imagen , estos modelos pueden entrenarse mediante redes neuronales recurrentes (RNN), como las redes de memoria a corto y largo plazo (LSTM), que se han utilizado para modelos de transformación de píxeles y modelos de generación de vídeo estocástico, los cuales contribuyen a la consistencia y el realismo, respectivamente. [ 41 ] Una alternativa a estos son los modelos transformadores. Las redes generativas antagónicas (GAN), los autoencoders variacionales (VAE), —que pueden ayudar en la predicción del movimiento humano [ 42 ] — y los modelos de difusión también se han utilizado para desarrollar los aspectos de generación de imágenes del modelo. [ 43 ]
Los conjuntos de datos de texto y vídeo utilizados para entrenar modelos incluyen, entre otros, WebVid-10M, HDVILA-100M, CCV, ActivityNet y Panda-70M. Estos conjuntos de datos contienen millones de vídeos originales de interés, vídeos generados, vídeos con subtítulos e información textual que ayudan a entrenar modelos para lograr precisión. Los conjuntos de datos de texto y vídeo utilizados para entrenar modelos incluyen, entre otros, PromptSource, DiffusionDB y VidProM. [ 44 ] [ 45 ] Estos conjuntos de datos proporcionan la gama de entradas de texto necesarias para enseñar a los modelos cómo interpretar una variedad de indicaciones textuales.
El proceso de generación de video implica sincronizar las entradas de texto con los fotogramas de video, asegurando la alineación y la coherencia a lo largo de la secuencia. Este proceso predictivo está sujeto a una disminución en la calidad a medida que aumenta la duración del video debido a limitaciones de recursos. [ 45 ] La prueba de Will Smith comiendo espaguetis es un punto de referencia para los modelos. [ 46 ]
Limitaciones
A pesar de la rápida evolución de los modelos de conversión de texto a vídeo en cuanto a su rendimiento, una limitación principal es su elevado coste computacional, lo que limita su capacidad para proporcionar resultados extensos y de alta calidad. Además, estos modelos requieren una gran cantidad de datos de entrenamiento específicos para generar resultados coherentes y de alta calidad, lo que plantea el problema de la accesibilidad. [ 43 ] [ 41 ]
Además, los modelos pueden malinterpretar las indicaciones textuales, lo que da como resultado vídeos que se desvían del significado previsto. Esto puede ocurrir debido a limitaciones en la captura del contexto semántico incrustado en el texto, lo que afecta la capacidad del modelo para alinear el vídeo generado con el mensaje previsto por el usuario. [ 43 ] [ 45 ] Varios modelos, incluidos Make-A-Video, Imagen Video, Phenaki, CogVideo, GODIVA y NUWA, se están probando y perfeccionando actualmente para mejorar sus capacidades de alineación y su rendimiento general en la generación de texto a vídeo. [ 43 ]
Otro problema con los resultados es que el texto o los detalles finos en los videos generados por IA a menudo aparecen distorsionados, un problema con el que también tienen dificultades los modelos de difusión estables . Algunos ejemplos son las manos deformadas y el texto ilegible.
Ética
El despliegue de modelos de conversión de texto a vídeo plantea consideraciones éticas relacionadas con la generación de contenido. Estos modelos tienen el potencial de crear contenido inapropiado o no autorizado, incluyendo material explícito, violencia gráfica, desinformación e imágenes de personas reales sin su consentimiento. Es fundamental garantizar que el contenido generado por IA cumpla con los estándares establecidos para un uso seguro y ético, ya que el contenido generado por estos modelos no siempre se identifica fácilmente como dañino o engañoso. La capacidad de la IA para reconocer y filtrar contenido inapropiado o protegido por derechos de autor sigue siendo un desafío constante, con implicaciones tanto para los creadores como para las audiencias. [ 44 ]
Impactos y aplicaciones
Los modelos de conversión de texto a vídeo ofrecen una amplia gama de aplicaciones que pueden beneficiar a diversos campos, desde la educación y la promoción hasta las industrias creativas. Estos modelos pueden agilizar la creación de contenido para vídeos de formación, avances de películas, recursos para videojuegos y visualizaciones, facilitando así la generación de contenido. [ 43 ]
Durante la guerra ruso-ucraniana , se crearon vídeos falsos con inteligencia artificial como parte de una campaña de propaganda contra Ucrania y se difundieron en redes sociales . Estos incluían representaciones de niños en las Fuerzas Armadas ucranianas , anuncios falsos dirigidos a niños que los animaban a denunciar a los críticos del gobierno ucraniano , o declaraciones ficticias del presidente ucraniano Volodymyr Zelenskyy sobre la rendición del país, entre otros. [ 47 ] [ 48 ] [ 49 ] [ 50 ] [ 51 ] [ 52 ]
Cine
Kaur vs Kore es el primer largometraje indio realizado con IA generativa que presenta un doble papel para el personaje de IA de Sunny Leone , cuyo estreno está previsto para 2026. [ 53 ] [ 54 ] [ 55 ]
Chiranjeevi Hanuman – The Eternal es una película india realizada completamente con IA generativa creada por Vijay Subramaniam, cuyo estreno en cines está previsto para 2026. La película fue ampliamente criticada por los cineastas de Bollywood por depender totalmente de la IA, y su uso fue visto como una amenaza existencial para sus carreras. [ 56 ] [ 57 ] [ 58 ]
Serie
Mahabharat: Ek Dharmayudh es una serie mitológica india para plataformas OTT estrenada en octubre de 2025 y transmitida en JioHotstar . Se la reconoce como la primera serie creada completamente con inteligencia artificial para generar imágenes y animaciones de personajes, y consta de 100 episodios. [ 59 ] [ 60 ] [ 61 ]
Craft (1979) es una serie de Minecraft generada por IA lanzada en junio de 2026, creada por el usuario LatentDiffusion usando Seedance 2.0 , la serie recibió elogios en línea por lograr capturar los sentimientos y experiencias de aquellos que jugaron Minecraft por primera vez en forma narrativa, y muchos usuarios afirmaron que la serie es mejor que la película oficial de 2025. [ 62 ]
Comparación de modelos
Véase también
- Modelo de conversión de texto a imagen
- Basura de IA
- VideoPoet , modelo de Google aún no lanzado, precursor de Lumière.
- Deepfake
- Síntesis de imágenes humanas
Referencias
- ↑ Informe del Índice de Inteligencia Artificial 2023 (PDF) (Informe). Instituto Stanford para la Inteligencia Artificial Centrada en el Ser Humano. pág. 98.
En 2022 se lanzaron varios modelos de texto a vídeo de alta calidad, sistemas de IA que pueden generar videoclips a partir de texto introducido.
- ^ Melnik, Andrés; Liublianac, Michal; Lu, Cong; Yan, Qi; Ren, Weiming; Ritter, Helge (6 de mayo de 2024). "Modelos de difusión de vídeo: una encuesta". arXiv : 2405.03150 [ cs.CV ].
- 1 2 Wodecki, Ben (11 de agosto de 2023). "Modelos de IA generativos de texto a vídeo: la lista definitiva" . AI Business . Informa . Recuperado el 18 de noviembre de 2024 .
- ↑ CogVideo , THUDM, 12 de octubre de 2022 , consultado el 12 de octubre de 2022
- ↑ Davies, Teli (29 de septiembre de 2022). "Make-A-Video: El nuevo modelo de Meta AI para la generación de texto a vídeo" . Weights & Biases . Recuperado el 12 de octubre de 2022 .
- 1 2 Monge, Jim Clyde (3 de agosto de 2022). "Esta IA puede crear vídeo a partir de una solicitud de texto" . Medium . Recuperado el 12 de octubre de 2022 .
- ↑ "La IA Make-A-Video de Meta crea vídeos a partir de texto" . www.fonearena.com . Consultado el 12 de octubre de 2022 .
- ↑ "google: Google se enfrenta a Meta e introduce su propia IA para la generación de vídeos" . The Economic Times . 6 de octubre de 2022. Consultado el 12 de octubre de 2022 .
- ↑ "No, Meta, nosotros también podemos hacer IA de texto a vídeo, dice Google" . The Register . Consultado el 12 de octubre de 2022 .
- ↑ "Papers with Code - See, Plan, Predict: Language-guided Cognitive Planning with Video Prediction" . paperswithcode.com . Consultado el 12 de octubre de 2022 .
- ↑ "Papers with Code - Text-driven Video Prediction" . paperswithcode.com . Consultado el 12 de octubre de 2022 .
- ↑ página, Will Douglas Heavenarchive. "La startup original detrás de Stable Diffusion ha lanzado una IA generativa para vídeo" . MIT Technology Review . Consultado el 17 de octubre de 2025 .
- ↑ Wiggers, Kyle (9 de junio de 2023). "La segunda generación de Runway muestra las limitaciones de la tecnología actual de conversión de texto a vídeo" . TechCrunch . Consultado el 17 de octubre de 2025 .
- ^ Luo, Zhengxiong; Chen, Dayou; Zhang, Yingya; Huang, Yan; Wang, Liang; Shen, Yujun; Zhao, Deli; Zhou, Jingren; Tan, Tieniu (2023). "VideoFusion: modelos de difusión descompuestos para generación de vídeo de alta calidad". arXiv : 2303.08320 [ cs.CV ].
- ↑ "Adobe lanza el modelo de vídeo Firefly y mejora los modelos de imagen, vector y diseño. Sala de prensa de Adobe" . Adobe Inc. 10 de octubre de 2024. Consultado el 18 de noviembre de 2024 .
- ↑ Yirka, Bob (26 de enero de 2024). "Google anuncia el desarrollo de Lumiere, un generador de texto a vídeo de próxima generación basado en IA" . Tech Xplore . Consultado el 18 de noviembre de 2024 .
- ↑ "Texto a voz para vídeos" . Synthesia.io . Consultado el 17 de octubre de 2023 .
- ↑ Nuñez, Michael (12 de junio de 2024). "Luma AI presenta 'Dream Machine' para la generación de vídeo realista, intensificando la carrera de la IA en los medios de comunicación" . VentureBeat . Recuperado el 18 de noviembre de 2024 .
- ↑ Fink, Charlie. "Apple presenta Intelligence, Mistral recauda 600 millones de dólares y un nuevo sistema de conversión de texto a vídeo con IA" . Forbes . Consultado el 18 de noviembre de 2024 .
- ↑ Franzen, Carl (12 de junio de 2024). "Lo que necesitas saber sobre Kling, el generador de vídeo con IA que compite con Sora y está asombrando a los creadores" . VentureBeat . Consultado el 18 de noviembre de 2024 .
- ↑ "ByteDance se une a los rivales de Sora de OpenAI con el lanzamiento de una aplicación de vídeo con IA" . Reuters . 6 de agosto de 2024. Consultado el 18 de noviembre de 2024 .
- ↑ "La IA china 'tigre' minimax lanza un modelo de generación de texto a vídeo para competir con sora de OpenAI" . Yahoo! Finanzas . 2 de septiembre de 2024. Consultado el 18 de noviembre de 2024 .
- ↑ Requiroso, Kelvene (15 de diciembre de 2024). "El modelo LTXV de Lightricks rompe récords de velocidad, generando videoclips de IA de 5 segundos en 4 segundos" . eWEEK . Consultado el 24 de julio de 2025 .
- ↑ Text2Video-Zero , Picsart AI Research (PAIR), 12 de agosto de 2023 , consultado el 12 de agosto de 2023
- ↑ Kemper, Jonathan (1 de julio de 2024). "Gen-3 Alpha, el competidor de Sora de Runway, ya está disponible" . THE DECODER . Consultado el 18 de noviembre de 2024 .
- ↑ "La próxima frontera de la IA generativa es el vídeo" . Bloomberg.com . 20 de marzo de 2023. Consultado el 18 de noviembre de 2024 .
- ↑ "OpenAI presenta 'Sora', su nuevo modelo de IA para convertir texto en vídeo" . NBC News . 15 de febrero de 2024. Consultado el 18 de noviembre de 2024 .
- ↑ Kelly, Chris (25 de junio de 2024). "Toys R Us crea el primer vídeo de marca que utiliza la herramienta de conversión de texto a vídeo de OpenAI" . Marketing Dive . Informa . Consultado el 18 de noviembre de 2024 .
- ↑ Jin, Jiayao; Wu, Jianhang; Xu, Zhoucheng; Zhang, Hang; Wang, Yaxin; Yang, Jielong (4 de agosto de 2023). «Texto a vídeo: Mejora de la generación de vídeo mediante modelos de difusión y redes de reconstrucción». 2.ª Conferencia Internacional de 2023 sobre Computación, Comunicación, Percepción y Tecnología Cuántica (CCPQT) . IEEE. págs. 108–114 . doi : 10.1109/CCPQT60491.2023.00024 . ISBN 979-8-3503-4269-7.
- ↑ "Anuncio de Black Forest Labs" . Black Forest Labs . 1 de agosto de 2024. Consultado el 18 de noviembre de 2024 .
- ↑ Forlini, Emily Dreibelbis (18 de septiembre de 2024). "El generador de texto a vídeo con IA veo de Google llegará a los cortos de YouTube" . PC Magazine . Consultado el 18 de noviembre de 2024 .
- ↑ Subin, Jennifer Elias, Samantha (20 de mayo de 2025). "Google lanza Veo 3, un generador de vídeo con IA que incorpora audio" . CNBC . Consultado el 22 de mayo de 2025 .
{{cite web}}: CS1 maint: varios nombres: lista de autores ( enlace ) - ↑ Fink, Charlie. "LTX Video rompe la barrera de los 60 segundos y redefine el vídeo con IA como un medio de formato largo" . Forbes . Consultado el 24 de julio de 2025 .
- ↑ "La última versión de Lightricks permite a los creadores dirigir vídeos de larga duración generados por IA en tiempo real" . SiliconANGLE . 16 de julio de 2025. Consultado el 24 de julio de 2025 .
- ↑ Shahaf, Tal (23 de octubre de 2025). "Lightricks presenta un potente modelo de vídeo con IA que desafía a OpenAI y Google" . Ynetglobal . Recuperado el 25 de octubre de 2025 .
- ↑ Baptista, Eduardo (13 de febrero de 2026). "El nuevo modelo de vídeo con IA de ByteDance se vuelve viral mientras China busca un segundo momento DeepSeek" . Reuters . Consultado el 14 de febrero de 2026 .
- 1 2 Maddaus, Gene (13 de febrero de 2026). "Después de que el video de IA de 'Tom Cruise' peleando con 'Brad Pitt' se volviera viral, la Motion Picture Association denuncia una infracción 'masiva' de Seedance 2.0" .
- ^ Milmo, Dan; Pulver, Andrew (13 de febrero de 2026). ""Se acabó para nosotros": el lanzamiento del nuevo generador de vídeo con IA, Seedance 2.0, inquieta a Hollywood" – vía The Guardian.
- ↑ "¿Qué es Seedance 2.5? Explicación del modelo de vídeo con IA de próxima generación de ByteDance" . MindStudio . 24 de junio de 2026.
- ↑ "ByteDance se prepara para lanzar Seedance 2.5 con salida de video de IA de 3 minutos" . testingcatalog . 4 de julio de 2026.
- ^ Bhagwatkar , Rishika; Bachu, Saketh; Montador, Khurshed; Kulkarni, Akshay; Chiddarwar, Shital (17 de diciembre de 2020). "Una revisión de los enfoques de generación de vídeos". 2020 Conferencia Internacional sobre Energía, Instrumentación, Control y Computación (PICC) . IEEE. págs. 1 a 5. doi : 10.1109/PICC51425.2020.9362485 . ISBN 978-1-7281-7590-4.
- ↑ Kim, Taehoon; Kang, ChanHee; Park, JaeHyuk; Jeong, Daun; Yang, ChangHee; Kang, Suk-Ju; Kong, Kyeongbo (3 de enero de 2024). «Generación de texto a vídeo con detección de movimiento humano y control explícito de la cámara». Conferencia de invierno IEEE/CVF 2024 sobre aplicaciones de visión por computadora (WACV) . IEEE. págs. 5069–5078 . doi : 10.1109/WACV57701.2024.00500 . ISBN 979-8-3503-1892-0.
- 1 2 3 4 5 Singh, Aditi (9 de mayo de 2023). "Un estudio de los generadores de texto a imagen y texto a vídeo mediante IA". 4.ª Conferencia Internacional sobre Inteligencia Artificial, Robótica y Control (AIRC) de 2023. IEEE. págs. 32-36 . arXiv : 2311.06329 . doi : 10.1109/AIRC57904.2023.10303174 . ISBN 979-8-3503-4824-8.
- 1 2 Miao, Yibo; Zhu, Yifan; Dong, Yinpeng; Yu, Lijia; Zhu, junio; Gao, Xiao-Shan (8 de septiembre de 2024). "T2VSafetyBench: Evaluación de la seguridad de los modelos generativos de texto a vídeo". arXiv : 2407.05965 [ cs.CV ].
- 1 2 3 Zhang, Ji; Mei, Kuizhi; Wang, Xiao; Zheng, Yu; Fan, Jianping (agosto de 2018). "Del texto al vídeo: aprovechamiento de la semántica de nivel medio para la clasificación de vídeo a gran escala". 24.ª Conferencia Internacional sobre Reconocimiento de Patrones (ICPR) de 2018. IEEE. págs. 1695–1700 . doi : 10.1109/ICPR.2018.8545513 . ISBN 978-1-5386-3788-3.
- ↑ Placido, Dani Di. "La IA de Google superó la prueba de 'Will Smith comiendo espaguetis'" . Forbes . Archivado del original el 3 de junio de 2025. Consultado el 1 de junio de 2025 .
- ↑ ქურასბედიანი, ალექსი (9 de junio de 2025). "Foto generada por IA de niños ucranianos con uniformes militares circuló en línea | Mythdetector.com" . Consultado el 16 de junio de 2025 .
- ↑ "Un falso anuncio sobre Ucrania insta a los niños a denunciar a sus familiares que disfrutan de música rusa" . Euronews . 28 de marzo de 2025. Consultado el 16 de junio de 2025 .
- ↑ "Fotos de niños ucranianos generadas por inteligencia artificial" . behindthenews.ua . 26 de junio de 2024. Consultado el 16 de junio de 2025 .
- ↑ "Un falso anuncio de televisión ucraniano insta a los niños a denunciar a sus familiares que escuchan música rusa" .
- ↑ "Un vídeo deepfake de Zelenskyy podría ser 'la punta del iceberg' en la guerra de información, advierten los expertos" . NPR . 16 de marzo de 2022. Consultado el 16 de junio de 2025 .
- ↑ "Guerra de Ucrania: Desmienten el vídeo deepfake de Zelenskyy instando a los ucranianos a 'deponer las armas'" . Sky News . Consultado el 16 de junio de 2025 .
- ↑ "'Kaur vs KORE': Sunny Leone está lista para interpretar un doble papel en una película basada en IA - Informe" . The Times of India . 24 de septiembre de 2025. ISSN 0971-8257 . Consultado el 26 de octubre de 2025 .
- ↑ Farzeen, Sana (24 de septiembre de 2025). "Exclusiva: Sunny Leone marca tendencia con su largometraje impulsado por IA 'Kaur vs KORE'"" . India Today . Consultado el 26 de octubre de 2025 .
- ↑ "Sunny Leone asume un doble papel como humana y avatar de IA en 'Kaur vs KORE'"" . @mathrubhumi . 24 de septiembre de 2025. Consultado el 26 de octubre de 2025 .
- ↑ Sharma, Manoj (26 de octubre de 2025). "Del Mahabharata a Hanuman: Vijay Subramaniam de Collective Artists Network habla sobre cómo la IA está dando forma al futuro del entretenimiento en la India" . Fortune India . Consultado el 26 de octubre de 2025 .
- ↑ PTI (20 de agosto de 2025). "Anurag Kashyap critica duramente al productor Vijay Subramaniam por la película generada por IA 'Chiranjeevi Hanuman'"." . The Hindu . ISSN 0971-751X . Consultado el 26 de octubre de 2025 .
- ^ "Se anunció la película generada por IA Chiranjeevi Hanuman, Vikramaditya Motwane no está contento con ella: 'Así comienza'" . Hindustan Times . 19 de agosto de 2025 . Consultado el 26 de octubre de 2025 .
- ↑ "Mahabharat: Ek Dharmayudh: estreno en OTT: cuándo y dónde ver la primera serie mitológica de la India con inteligencia artificial" . The Economic Times . 23 de octubre de 2025. ISSN 0013-0389 . Consultado el 26 de octubre de 2025 .
- ↑ "'Con AI Mahabharat, los espectadores podrán experimentar la misma historia de una forma nueva'." . The Times of India . 18 de octubre de 2025. ISSN 0971-8257 . Consultado el 26 de octubre de 2025 .
- ↑ Ramachandran, Naman (10 de octubre de 2025). "Se estrena el tráiler de 'Mahabharat' con IA antes de su debut en India (EXCLUSIVA)" . Variety . Consultado el 26 de octubre de 2025 .
- ↑ Difusión, Latente (1 de junio de 2026). "CRAFT (1979): La primera noche" . Youtube . Consultado el 1 de junio de 2026 .
- 1 2 3 4 5 6 "Los mejores modelos de generación de vídeo con IA de 2024" . Deepgram . Consultado el 30 de agosto de 2024 .
- 1 2 "Vexub – Generador de IA de texto a vídeo" . Vexub . Consultado el 25 de junio de 2025 .
- 1 2 "Runway Research | Gen-2: Genera vídeos novedosos con texto, imágenes o videoclips" . runwayml.com . Consultado el 30 de agosto de 2024 .
- 1 2 Sharma, Shubham (26 de diciembre de 2023). "La plataforma de IA de texto a vídeo de Pika Labs se abre a todos: Aquí te explicamos cómo usarla" . VentureBeat . Recuperado el 30 de agosto de 2024 .
- 1 2 "Runway Research | Presentando Gen-3 Alpha: Una nueva frontera para la generación de vídeo" . runwayml.com . Consultado el 30 de agosto de 2024 .
- ↑ "Conoce Flow, la creación de películas con IA con Veo 3" . blogs.google.com . 20 de mayo de 2025. Consultado el 6 de julio de 2025 .
- ↑ "Google Veo DeepMind" . google.com . Consultado el 6 de julio de 2025 .
- 1 2 "Sora | OpenAI" . openai.com . Consultado el 30 de agosto de 2024 .
- ↑ Lightricks. "Lightricks lanza LTX-2: el primer modelo completo de base de vídeo con IA de código abierto" . www.prnewswire.com . Consultado el 23 de abril de 2026 .
- ↑ Mink, Zach. "El vídeo con IA rompe la barrera de los 60 segundos" . The Rundown AI . Consultado el 23 de abril de 2026 .
- ↑ Nuñez, Michael (31 de marzo de 2025). "Runway Gen-4 resuelve el mayor problema del vídeo con IA: la coherencia de los personajes entre escenas" . VentureBeat . Archivado del original el 21 de julio de 2025. Consultado el 17 de octubre de 2025 .
- ↑ "El nuevo sistema de IA Gen-4 de Runway promete la creación de medios más predecible hasta la fecha | No Film School" . nofilmschool.com . Consultado el 17 de octubre de 2025 .
- ↑ Wiggers, Kyle (31 de marzo de 2025). "Runway lanza un impresionante nuevo modelo de IA para la generación de vídeo" . TechCrunch . Consultado el 17 de octubre de 2025 .
- 1 2 Mehta, Ivan (16 de diciembre de 2025). "Adobe Firefly ahora admite la edición de video basada en indicaciones y agrega más modelos de terceros" . TechCrunch . Recuperado el 7 de marzo de 2026 .
- ↑ Ha, Anthony (15 de febrero de 2026). "Hollywood no está contento con el nuevo generador de vídeo Seedance 2.0" . TechCrunch . Consultado el 7 de marzo de 2026 .
- ↑ Ha, Anthony (10 de abril de 2026). "HappyHorse de Alibaba encabeza Seedance, ofreciendo una visión de la carrera de China por el talento en IA" . South China Morning Post . Consultado el 10 de abril de 2026 .
- Ingeniería de inteligencia artificial
- Algoritmos
- Idioma
- Procesamiento del lenguaje natural
- Video
- Generación de texto a vídeo