Vídeo con IA fotorrealista: entre uno y veinte años de espera
Dos clips pegados que no se notan. Una mujer que no existe, en un plató que tampoco, con una luz que casi convence. El resultado ya no es el esperpento de dedos y extremidades de hace tres años, y justo por eso el asunto se ha vuelto incómodo:
las estimaciones que manejan los participantes sobre cuánto falta para que un vídeo generado por IA sea indistinguible de uno real van del año a las dos décadas. Nadie discute el salto. La discrepancia es el calendario.
Qué se ve hoy en un vídeo generado por IA
El material que circula se apoya en herramientas como Seedance 2, capaz de alargar escenas y encadenar fragmentos distintos hasta que parezcan una sola toma. La costura se disimula recortando unos fotogramas. Queda un vídeo de aire nocturno, tipo
late night, con una presentadora virtual que sonríe, parpadea y busca la complicidad del espectador. El nivel, admiten los más críticos, está más alto de lo que creían.
Los fallos siguen ahí, según los propios participantes. Un usuario resume el problema diciendo que los cuerpos se ven
gomosos. Otro enumera lo que queda por pulir: miradas muertas, personajes que cambian de rasgos entre plano y plano, iluminación que no acaba de comportarse y físicas resueltas a brocha gorda. Encima, un catálogo de manierismos repetidos que delatan al modelo. Hace tres años se hablaba de dedos de más. Hoy se habla de textura de piel.
¿Cuántos años faltan para superar el uncanny valley?
La horquilla es amplísima. Una parte sostiene que el vídeo fotorrealista que no dé el cante llega
en un año como máximo, y se apoya en que las mejoras son incrementales y en que el material de referencia lo ha hecho un aficionado al que le daba igual la calidad de las voces.
La postura contraria es menos optimista. El valle inquietante sería más ancho de lo que parece: la IA puede acercarse al
99,9% de realismo y aun así quedarse en un punto que produce rechazo. De ahí salen plazos de hasta
20 años. Una tercera predicción sostiene que en cinco años el contenido para adultos con personas reales será un nicho residual.
Qué es Seedance 2 y la función Omnireference
Es la pieza técnica que explica el salto. La función Omnireference permite alargar los vídeos y encadenar clips distintos, que en general se unen sin costuras. El montaje se cierra recortando unos fotogramas en las uniones. Sin esa continuidad, el truco se cae.
El cuello de botella que nadie ha resuelto: el tacto
Falta la otra mitad. Esto genera imágenes, no contacto. Ahí se abre un mercado que ninguna herramienta cubre, y las soluciones que se mencionan van del sensor táctil virtual al holograma superpuesto sobre una carcasa, como en
Futurama. Quien dé con eso, se dice, se forra. La demanda existe. La interfaz, no.
Con estos mimbres, las cifras no cuadran entre sí. Un año. Cinco. Veinte. Tres para llegar hasta aquí. Cuatro plazos, ni una coincidencia, y ninguna forma de saber cuál se cumplirá.