Anthropic acordó pagar 1.500 millones de dólares a un grupo de escritores para cerrar una demanda por derechos de autor, el mayor acuerdo de este tipo en la historia de las acciones colectivas en Estados Unidos. La cifra es enorme, pero la letra chica cuenta otra historia: el pago no castiga el entrenamiento de sus modelos de inteligencia artificial, sino la forma en que la empresa consiguió los libros.
La compensación cubre unas 482.460 obras que Anthropic habría descargado desde bases de datos piratas para nutrir su sistema. Es decir, el problema legal no fue usar los textos para enseñarle a un modelo, sino obtenerlos por vías ilícitas en lugar de comprarlos o licenciarlos.
Por qué un acuerdo millonario es, en realidad, un alivio para la industria
La distinción es clave para entender el fallo. El juez William Alsup, del distrito norte de California, ya había establecido antes que entrenar un modelo de IA con libros obtenidos de forma legal es un uso «transformativo» y queda amparado por la doctrina del fair use (uso justo), la figura del derecho estadounidense que permite reutilizar obras protegidas bajo ciertas condiciones sin autorización del titular.
Con esa lógica, la demanda quedó reducida a un asunto de piratería, no de tecnología. Anthropic paga por cómo consiguió el material, no por lo que hizo con él. Para el resto de los laboratorios que desarrollan grandes modelos de lenguaje —sistemas entrenados con enormes cantidades de texto para generar y comprender lenguaje natural—, el mensaje es tranquilizador: entrenar con obras adquiridas legalmente tiene respaldo judicial.
El tribunal aprobó el acuerdo que zanja el litigio. Repartido entre las obras afectadas, el monto ronda los 3.000 dólares por libro, una suma considerable frente a lo que suelen recibir los autores en disputas de este tipo.
Una hoja de ruta para conseguir datos sin pleitos
El desenlace deja una lección práctica para las empresas de IA: la vía para evitar demandas millonarias pasa por licenciar o comprar los contenidos con los que entrenan sus sistemas, en vez de recurrir a repositorios piratas. Varias compañías del sector ya avanzaron en esa dirección con acuerdos de licencia con editoriales y medios de comunicación.
El caso también expone la tensión de fondo que arrastra toda la industria. Los modelos actuales necesitan volúmenes gigantescos de texto para funcionar, y buena parte de ese material está protegido por derechos de autor. La pregunta de quién debe cobrar, y cuánto, cuando una obra alimenta a una máquina que luego genera contenido sigue sin una respuesta uniforme.
Anthropic, creadora del asistente Claude, se presenta como una empresa enfocada en el desarrollo seguro de la IA. El acuerdo le permite dejar atrás un frente judicial incómodo sin sentar un precedente que amenace el corazón de su negocio.
Qué queda abierto
El fallo no cierra el debate legal sobre la IA generativa. Otros tribunales estadounidenses tramitan demandas similares contra distintas compañías, y no todos los jueces tienen por qué compartir el criterio de Alsup sobre el uso justo. En Europa, además, las reglas sobre minería de datos y derechos de autor siguen su propio camino.
Por ahora, el resultado deja una frontera más nítida que antes: piratear el material para entrenar es caro y arriesgado; entrenar con lo que se obtuvo de forma legal, mucho menos. La discusión sobre si eso basta para tratar de forma justa a quienes escriben los libros apenas empieza.
