Un grupo de editores de noticias encabezado por The New York Times presentó una nueva ofensiva legal contra OpenAI: sostienen que la empresa ocultó herramientas y conjuntos de datos que permitirían identificar contenido periodístico protegido por derechos de autor dentro de las respuestas de ChatGPT. Con esa acusación, los demandantes solicitaron sanciones judiciales, un paso que eleva la tensión en uno de los litigios más observados de la industria de la inteligencia artificial.
El reclamo, reportado por TechCrunch, forma parte de la demanda que los editores mantienen desde hace más de dos años contra OpenAI y su socio Microsoft. En el centro está una pregunta que aún no tiene respuesta jurídica clara: si entrenar modelos de lenguaje con artículos periodísticos sin licencia ni pago constituye una infracción o queda amparado por el uso legítimo.
Qué reclaman los editores
Según la nueva moción, OpenAI habría retenido instrumentos internos y bases de datos que servirían para rastrear cuándo y cómo aparece material con derechos de autor en los textos que genera ChatGPT. Para los demandantes, esa información es clave para demostrar que el modelo reproduce fragmentos de sus notas, y su supuesta ocultación justificaría que el tribunal imponga sanciones.
Una moción por sanciones es un recurso que una parte usa cuando considera que la contraria incumplió sus obligaciones durante el proceso de intercambio de pruebas, conocido como discovery. Si un juez la concede, puede traducirse en multas, en la obligación de entregar el material o, en casos extremos, en instrucciones que perjudiquen la posición de la parte sancionada ante el jurado.
Los modelos de lenguaje como el que sustenta ChatGPT se entrenan con enormes volúmenes de texto extraído de internet, incluidos artículos de prensa. Los editores argumentan que ese entrenamiento aprovechó su trabajo sin autorización y que, además, el sistema puede devolver a los usuarios pasajes muy parecidos a los originales, lo que competiría directamente con su negocio.
Un litigio con implicaciones amplias
La disputa entre The New York Times y OpenAI se convirtió en el caso testigo de una serie de demandas presentadas por medios, autores y artistas que reclaman por el uso de sus obras en el desarrollo de sistemas de IA generativa. Su resolución podría fijar un precedente sobre cómo las empresas tecnológicas obtienen y utilizan los datos que alimentan sus productos.
OpenAI ha sostenido en el pasado que su uso de material disponible públicamente se ajusta a la doctrina del uso legítimo y que trabaja en acuerdos de licencia con distintos editores. La compañía no reconoce las infracciones que se le imputan y ha defendido que las coincidencias textuales serían casos aislados y no el comportamiento habitual del modelo.
El resultado del juicio importa mucho más allá de las partes involucradas. Si prospera la tesis de los editores, las empresas de IA podrían verse obligadas a pagar por el contenido que usan para entrenar sus sistemas o a rediseñar la forma en que arman sus conjuntos de datos. Un fallo a favor de OpenAI, en cambio, consolidaría la práctica actual de la industria.
Qué sigue
Por ahora, corresponde al tribunal decidir si acepta la moción por sanciones y qué peso da a la acusación de ocultamiento de pruebas. Cualquiera sea la vía, el episodio muestra hasta qué punto el acceso a la información técnica interna de los desarrolladores se volvió un campo de batalla tan relevante como el debate de fondo sobre los derechos de autor.
