Nuevos documentos desclasificados, en el marco de la demanda del New York Times contra OpenAI y Microsoft, exponen que ambas compañías estaban al tanto del impacto y la naturaleza de sus acciones al utilizar artículos de prensa para entrenar sus modelos de inteligencia artificial. Las revelaciones incluyen preocupaciones internas sobre el 'robo laboral' y el potencial destructivo para la industria periodística, así como la implementación de herramientas para eludir muros de pago.
A finales de 2023, The New York Times interpuso una demanda contra OpenAI y Microsoft, acusándolas de emplear sus contenidos periodísticos para el entrenamiento de modelos de inteligencia artificial sin la debida autorización ni compensación. A esta acción legal se sumaron posteriormente otros once medios de comunicación. Ahora, The New York Times ha hecho públicos diversos documentos internos que fueron desclasificados en el contexto de la demanda, los cuales demuestran que en ambas compañías existían voces plenamente conscientes de las implicaciones de sus prácticas.
La expresión 'el mayor robo laboral de la historia' aparece en un documento interno de Microsoft de 2023, redactado por Brent Hecht, director de ciencia aplicada de la empresa. Se refiere al hecho de que OpenAI, en ese momento su socio más cercano, estuviera entrenando sus modelos con artículos de prensa.
Hecht añadió que 'Millones de personas en todo el mundo pronto considerarán que el hecho de que grandes modelos 'absorban' todo su trabajo es un robo asombroso de proporciones sin precedentes' y manifestó su preocupación por el futuro de la industria periodística, afirmando que los modelos de IA 'son un producto que destruye su cadena de suministro'. Esto indica un claro conocimiento de lo que estaban haciendo.
OpenAI también estaba al tanto de esta situación, probablemente mejor que nadie, y existen numerosas pruebas de ello. En 2020, mucho antes del lanzamiento de ChatGPT, Jack Clark (entonces director de políticas de OpenAI y actual cofundador de Anthropic) envió un informe a Sam Altman y Greg Brockman en el que advertía que su trabajo los llevaría a crear sistemas que 'sustituyan el trabajo de las personas que definen la cultura de la sociedad'.
Los abogados de los medios demandantes argumentan que OpenAI implementó herramientas específicamente diseñadas para sortear los muros de pago de los editores. Entre los documentos desclasificados se encuentra un mensaje en el que Greg Brockman, presidente de OpenAI, celebra que un empleado hubiera desarrollado 'un truco para sortear el muro de pago de The New York Times'.
Satya Nadella, CEO de Microsoft, declaró que 'cualquier cosa que esté restringida por un muro de pago debería estar sujeta a licencia para cualquiera que quiera usarla'. Asimismo, aseguró que si 'hubiera tenido conocimiento de que OpenAI había extraído y entrenado información que estaba detrás de un muro de pago', les habría exigido que reentrenaran sus modelos, un derecho que Microsoft poseía.
En junio de 2023, Nick Turley, responsable de desarrollo de ChatGPT, escribió en un documento que la inteligencia artificial representaba una 'amenaza existencial' para el periodismo. Un año después, afirmó que 'Los productos de IA son en gran medida sustitutivos, punto'. Es decir, OpenAI anticipaba que ChatGPT no actuaría como un intermediario o una nueva fuente de descubrimiento, como podría ser Google Discover, sino que reemplazaría el consumo de noticias.
Un ingeniero de OpenAI advirtió en 2023 que, por más que ChatGPT citara las fuentes con enlaces, los usuarios no harían clic, y no estaba equivocado. A medida que se extendió la adopción de los chatbots, los usuarios comenzaron a usar la IA cada vez más como un motor de búsqueda, y la incorporación de los resúmenes de IA en los resultados de Google provocó una significativa disminución del tráfico, con caídas de más del 50% en algunos casos.