Anthropic aprueba el acuerdo de 1.500 millones por libros pirateados usados para entrenar Claude
Un juez federal aprobó el acuerdo de 1.500 millones de dólares entre Anthropic y un grupo de autores que denunciaron el uso de libros protegidos por copyright para entrenar Claude. Los autores reciben aproximadamente 3.000 dólares por cada libro, y más del 91% de los titulares involucrados ha reclamado su parte. El despacho de los demandantes lo describe como el mayor resarcimiento por copyright de la historia.
Por qué te importa. Si construyes algo sobre un modelo entrenado por otros, el costo de entrenamiento ha sido hasta ahora un número opaco: sabes cuánto pagas por la inferencia, no cuánto costó meter los datos en el modelo. Este acuerdo hace dos cosas concretas. Establece un precio por libro usado sin licencia: 3.000 dólares. Y desplaza el riesgo hacia quien entrena hoy. Si mañana armas un dataset con materiales protegidos, el precedente dice qué puede pasar.
No es solo Anthropic. Otras demandas similares siguen abiertas. Quien entrena modelos propios o fine-tunea con datos recopilados de la web se enfrenta a un panorama que se densifica. Como señalábamos el 14 de julio retomando las críticas de Nadella a laboratorios que entrenan con datos ajenos, la práctica es generalizada. Ahora tiene precio.
En detalle
La demanda comenzó en 2024. Andrea Bartz, Charles Graeber y Kirk Wallace Johnson acusaron a Anthropic de descargar millones de libros protegidos en lo que el juez William Alsup describió como «descarga estilo Napster». El término usado por Alsup, quien luego se jubiló, refleja la idea de una extracción masiva y automatizada de archivos digitales sin permiso. En audiencias previas, Alsup concedió a Anthropic una victoria parcial sobre uso transformativo, reconociendo que transformar un texto para entrenar un modelo puede entrar en fair use, pero aun así certificó la acción colectiva sobre piratería sistemática, dejando abierto el frente de los daños.
Anthropic aceptó los 1.500 millones en septiembre de 2025. La jueza Araceli Martínez-Olguín firmó la aprobación definitiva el lunes 21 de julio de 2026, escribiendo que el acuerdo proporciona «meaningful relief» a los autores. La firma definitiva llega casi un año después del anuncio, tiempo necesario para verificar las reclamaciones de resarcimiento y gestionar objeciones de quienes consideraban la suma insuficiente.
Los números. El resarcimiento promedio es de aproximadamente 3.000 dólares por libro. El despacho de los demandantes lo define como la recuperación por copyright más grande jamás obtenida en Estados Unidos, un récord que pesa sobre toda la industria. Anthropic declara que más del 91% de autores y editores involucrados ha reclamado su parte, y la general counsel Aparna Sridhar habla de «cerrar el asunto». El porcentaje alto de adhesión indica que la mayoría prefirió cobrar inmediatamente en lugar de continuar en tribunales con resultado incierto.
El cierre es parcial. Chicken Soup for the Soul y otros autores tienen demandas abiertas contra Anthropic, argumentando que 3.000 dólares por libro no cubren el daño derivado del uso comercial de sus obras. TechCrunch señala que el acuerdo cierra un caso pero no resuelve el problema más amplio del uso de obras protegidas para entrenar modelos. La cuestión fundamental sobre si el entrenamiento con datos protegidos por copyright es legal per se sigue sin resolverse.
Qué cambia para quien construye. El precedente hace cuantificable el riesgo legal del entrenamiento con datos sin licencia. Si estás armando un dataset para fine-tuning o entrenar un modelo desde cero, y contiene textos protegidos, ahora sabes el orden de magnitud del costo. Debes preguntarte si los márgenes de tu aplicación aguantan un eventual resarcimiento calculado a escala similar. Esto aplica también si usas un modelo de terceros: el proveedor que entrenó con datos pirateados lleva consigo un riesgo que antes era teórico y ahora tiene un número asociado. Elegir un modelo significa también heredar su exposición legal.
Los límites de lo que sabemos. El acuerdo concierne un caso específico y una clase particular de autores. No es un fallo sobre el fondo del fair use para entrenamiento IA: es un acuerdo transaccional que evita el juicio. Las demandas abiertas podrían establecer precedentes distintos, quizás más favorables a los laboratorios o más punitivos. Y el precio de 3.000 dólares por libro es específico de este acuerdo, no una tarifa general aplicable a todos. Las negociaciones futuras dependerán de la visibilidad de las obras y del valor comercial del modelo entrenado.