La IA genera vídeo hiperrealista: de 140 millones a 20 euros
Un dron que salta, gira y cae en vertical. Una persona que habla a cámara con la piel, el pelo y los reflejos en su sitio. Nada de eso se ha rodado. La generación de vídeo por
inteligencia artificial ha dejado de ser una curiosidad de laboratorio: hay clips que, a pantalla completa, cuesta distinguir de una grabación real. El salto no es estético. Es económico. Y esa es la parte incómoda del asunto.
¿Cuánto cuesta un plano que antes exigía 500 especialistas?
La comparación que recorre toda la conversación es brutal:
500 expertos en efectos especiales, un año de trabajo y 140 millones de dólares frente a una sola persona, una semana y 20 euros. Suena a folleto de venta, pero el orden de magnitud explica por qué la industria audiovisual mira de reojo a los modelos generativos. El desglose completo de esa cuenta, con las partidas que se ponen una al lado de la otra, es donde se ve de verdad el desplazamiento de costes. Una IA no cobra jornada, no se pone enferma y no negocia convenio.
Ahí aparece el primer damnificado con nombre y factura.
Actores que no envejecen y locutores perfectos sin maquillaje. El diagnóstico más repetido es que se trata de otro colectivo camino de la cola del paro, aunque no todo el mundo lo firma: también hay quien sostiene que estas herramientas abaratan la producción y abren la puerta a quien nunca tuvo presupuesto para rodar.
El valle inquietante y los fallos que delatan a la máquina
El realismo tiene un límite y tiene nombre técnico. El
valle inquietante describe esa franja en la que un robot o un rostro generado se parece lo suficiente al humano como para provocar rechazo, y desaparece cuando la similitud es total. El problema práctico hoy es otro: la
consistencia entre planos. Un clip suelto sale impecable; encadenar diez con el mismo personaje, la misma ropa y la misma luz ya no. Hay quien lo resume con sorna: eso funciona porque está adaptado a un caso concreto, con cualquier otro se cae. La física de los objetos, la coherencia narrativa y el sonido sincronizado siguen siendo el muro.
Cine sin Blackrock: la promesa que nadie ha verificado
Una corriente del análisis pone el foco en el efecto cultural, no en el técnico. Si cualquiera puede producir imagen en movimiento, se argumenta,
se rompe el oligopolio del cine y de la cultura y la oferta se multiplica sin necesidad de un gran fondo de inversión detrás. Es la versión optimista, y convive con la pesimista: un océano de contenido donde lo bueno se ahoga entre el ruido. La realidad que ya se observa es más pedestre: canales que proliferan como setas y una mayoría de piezas que no aguantan un visionado entero.
¿Se puede hacer un deepfake en tiempo real?
Es la pregunta que se queda sin respuesta cerrada. Existe software para generar a una persona conocida diciendo algo que no ha dicho, y la duda siguiente es si eso puede sostenerse en directo, en una videollamada, con una identidad falsa al otro lado durante toda la conversación. Nadie en el intercambio aporta una solución ni una fecha. La sospecha es razonable: si el vídeo sintético ya engaña a simple vista en diferido, el paso al tiempo real es una cuestión de cómputo, no de principio.
Lo que la IA todavía no sabe hacer
Conviene bajar el hype. Generar clips cortos y espectaculares no equivale a construir un videojuego en 3D, que exige sonido, música, espacio, físicas niveladas, programación de alto nivel y una narrativa que sostenga horas de juego. La predicción que se maneja es que
2025 será el año del vídeo generativo aceptable para uso profesional, y que un juego de la talla de una consola antigua sería señal de que se ha cruzado otra frontera. Mientras tanto, las proyecciones van más rápido que los resultados: películas completas en un año o dos, agentes autónomos después y androides indistinguibles a simple vista al final de ese camino. Un escenario que, admiten incluso sus defensores, resulta impresionante y acojonante a partes iguales.
El punto exacto donde el análisis se atasca: nadie sabe cuánto tarda en resolverse el problema de la consistencia, y sin eso la promesa del cine automatizado se queda en una colección de fragmentos deslumbrantes que no encajan entre sí.