La nueva generación de vídeos generados por IA: calidad creciente, riesgos mayores
El avance reciente en modelos de video generativo —representado por herramientas como Sora 2 de OpenAI y desarrollos similares de la industria— ha elevado la calidad de los deepfakes a niveles hasta hace poco inimaginables: mejor continuidad de fotogramas, físicas más verosímiles y sonidos sincronizados que hacen que muchas creaciones resulten indistinguibles de material grabado. Medios internacionales han documentado cómo estas aplicaciones permiten generar clips cortos en 4K aparente, con movimientos coherentes y continuidad espacial, lo que agrava los ya conocidos riesgos de desinformación y fraude.
El fenómeno no es solo técnico: plataformas y fabricantes han ofrecido estas capacidades con interfaces pensadas para el público general, lo que democratiza su uso y, a la vez, baja la barrera de entrada para actores malintencionados. Pruebas recientes realizadas por medios de referencia evidencian que varios sitios y redes sociales aún no etiquetan ni identifican correctamente ese contenido como sintético, pese a existir estándares técnicos (C2PA) y a propuestas de marcado de IA. En un ejercicio de laboratorio, The Washington Post subió videos falsos a ocho plataformas y constató que sólo una informó de su origen sintético al usuario.
Las implicaciones son múltiples. En primer lugar, la confianza pública en el testimonio audiovisual —hasta ahora pilar de muchas pruebas y narrativas— queda erosionada. Ya se han documentado campañas políticas que usan clips generados para atribuir discursos falsos a líderes, anuncios virales que manipulan eventos y estafas telefónicas y mediáticas que emplean clonación de voz y video. The Guardian y Time han recogido casos donde políticos y figuras públicas han sido víctimas directas, y subrayan el potencial desestabilizador en contextos electorales.
En segundo lugar, existe un problema regulatorio y de responsabilidad técnica. Aunque algunas iniciativas (leyes como la Take It Down Act en EE. UU. y estándares internacionales) buscan mitigar daños, los mecanismos de verificación de edad, consentimiento y trazabilidad todavía son incipientes. UNESCO y organismos internacionales advierten que la proliferación de deepfakes plantea una “crisis del conocimiento”: cuando el audiovisual deja de ser fiable, se deterioran pruebas judiciales, procesos periodísticos y la memoria pública.
Además, la economía de la atención y el diseño de plataformas favorecen la viralidad de lo sensacional: un deepfake convincente se propaga más rápido que las correcciones, y las plataformas monetizan alcance sin mecanismos robustos de control previo. La experiencia reciente muestra que la etiqueta “contenido generado por IA” no es suficiente: la audiencia no siempre la percibe o la respeta, y la corrección post-difusión llega cuando el daño ya está hecho.
Técnicamente, hay soluciones parciales: huellas digitales de modelos (watermarking robusto), firmas criptográficas en metadatos y detección basada en trazas forenses pueden ayudar, pero los desarrolladores de generadores avanzan rápidamente y ciertas técnicas adversariales permiten eludir detectores. Por eso muchos expertos coinciden: la solución tecnológica sola no bastará. Se requieren tres ejes combinados: regulación clara y ágil, responsabilidad empresarial (marcado, límites de acceso y auditorías) y alfabetización mediática masiva.
Finalmente, hay un componente ético y cultural. La posibilidad de recrear voces o imágenes de personas fallecidas —a menudo presentada como “homenaje”— plantea preguntas sobre consentimiento, dignidad y lucro. Legislaciones y códigos deontológicos están en proceso, pero la rapidez del despliegue técnico excede la capacidad normativa. El dilema es claro: la misma tecnología que democratiza la creatividad puede, sin salvaguardas, corroer la posibilidad de distinguir entre lo real y lo fabricado.
En conclusión, la mejora en la calidad de los videos generados por IA exige una respuesta multidimensional: avances técnicos en trazabilidad y detección, reglas legales que definan responsabilidades y sanciones, prácticas empresariales más transparentes y una urgente campaña global de alfabetización para que ciudadanos, periodistas y autoridades aprendan a cuestionar y verificar lo que ven. Sin esas tres patas, la sociedad corre el riesgo de que lo visual —antes refugio de la evidencia— devenga en mera superficie manipulable.
Foto: Panorama digital

