Documentos judiciales desclasificados en el histórico litigio de The New York Times contra OpenAI y Microsoft han sacado a la luz una impactante verdad: ambas compañías sabían perfectamente que el entrenamiento de sus modelos de inteligencia artificial desencadenaba un "bucle de la muerte" (doom loop) para el ecosistema digital. Las comunicaciones internas de los desarrolladores no solo advertían sobre la destrucción del modelo económico de los medios de comunicación, sino que llegaron a calificar el raspado masivo de datos como "el mayor robo de trabajo de la historia de la humanidad".
Documentos judiciales revelan la verdad sobre OpenAI y Microsoft
La demanda presentada a finales de 2023 por The New York Times en el Tribunal de Distrito de los Estados Unidos para el Distrito Sur de Nueva York ha tomado un giro definitivo tras la desclasificación de correos electrónicos y memorandos internos. Estos textos demuestran que tanto los ejecutivos de OpenAI, liderados por Sam Altman, como la directiva de Microsoft, encabezada por Satya Nadella, conocían los devastadores efectos secundarios que tendría ChatGPT en la economía del conocimiento.
A pesar de las declaraciones públicas donde defendían que el uso de artículos informativos, libros y blogs constituía un "uso justo" (fair use), las discusiones a puerta cerrada reflejaban una profunda preocupación moral y técnica sobre la viabilidad a largo plazo de la web abierta.
"Estamos iniciando un bucle de destrucción donde consumimos el contenido de la web sin devolver tráfico ni valor, destruyendo la fuente de la que dependemos. Esto podría ser el mayor robo de trabajo en la historia de la humanidad." - Extracto de documentación interna revelada en el tribunal.
¿Qué es el "bucle de la muerte" de internet?
El concepto de " doom loop" o bucle de autodestrucción citado en los archivos del caso describe un fenómeno en cadena donde la inteligencia artificial generativa termina con su propia materia prima. El mecanismo advertido por los propios ingenieros se desarrolla en las siguientes fases:
- Extracción masiva de datos: Los bots de OpenAI e IP de Microsoft raspan de forma automatizada millones de artículos de noticias, investigaciones y blogs protegidos por derechos de autor.
- Pérdida de tráfico web: Los usuarios obtienen respuestas directas mediante herramientas como ChatGPT o Microsoft Copilot, eliminando la necesidad de hacer clic en los enlaces originales de los creadores.
- Asfixia económica de los medios: Sin visitas, los periódicos, medios independientes y creadores pierden sus ingresos por publicidad y suscripciones digitales.
- Cese de producción de nuevo contenido: Al no ser rentables, los medios quiebran o reducen drásticamente sus plantillas periodísticas.
- Degradación de los modelos de IA: La IA se queda sin información humana fresca para entrenarse y comienza a alimentarse de contenido sintético generado por otras IA, provocando lo que los científicos llaman "colapso del modelo".
El dilema del contenido sintético y la degradación de los datos
Los ingenieros de OpenAI advirtieron expresamente que alimentar a modelos avanzados como GPT-4 con texto generado por IA anteriores degrada de manera irreversible la calidad de las respuestas. Sin un flujo continuo de periodismo humano, verificado y actualizado, la utilidad de ChatGPT caerá inevitablemente con el paso del tiempo.
El impacto económico: El "robo de trabajo" en cifras
Durante años, la industria tecnológica sostuvo que la indexación de contenidos beneficiaba a los editores al derivarles tráfico. Sin embargo, las métricas presentadas en la causa judicial demuestran que la integración de la IA generativa en los motores de búsqueda ha reducido el tráfico saliente hacia los sitios web de noticias entre un 20% y un 60% en el último año.
| Indicador | Impacto estimado por IA |
|---|---|
| Tráfico referido a medios | Reducción del 20% al 60% |
| Ingresos publicitarios digitales | Pérdida de miles de millones de dólares |
| Volumen de datos raspados sin licencia | Más de 500.000 millones de palabras |
La acusación del New York Times enfatiza que Microsoft y OpenAI han utilizado indebidamente miles de millones de dólares en propiedad intelectual para crear productos comerciales valorados en más de 80.000 millones de dólares, sin compensar adecuadamente a las fuentes originales de información.
Reacciones de la industria y el futuro del derecho de autor
El destape de estos documentos consolida la postura de decenas de demandas colectivas iniciadas por autores, artistas, medios de comunicación como Getty Images y cadenas como CNN. Mientras algunas empresas como Axel Springer o Reddit han optado por firmar acuerdos millonarios de licencia de contenidos con OpenAI, el caso de The New York Times busca sentar un precedente legal definitivo sobre la regulación del web scraping.
¿Es posible salvar el ecosistema de la web abierta?
Expertos en tecnología y legislación sugieren que el modelo actual de la IA generativa debe cambiar radicalmente. La solución pasa por la implementación de un sistema de regalías obligatorio similar al de la industria musical, o la creación de un nuevo protocolo web donde los creadores puedan bloquear activamente el rastreo sin perder visibilidad en los motores de búsqueda tradicionales.
El juicio entre The New York Times, OpenAI y Microsoft promete redefinir las reglas del juego en la era digital. Si los tribunales determinan que el entrenamiento no autorizado de modelos de IA constituye una infracción masiva del copyright, los gigantes de Silicon Valley podrían verse obligados a borrar sus modelos actuales y pagar indemnizaciones multimillonarias que cambiarían la industria tecnológica para siempre.