Por qué Anthropic destruyó millones de libros para entrenar su inteligencia artificial

Máquinas hidráulicas cortaban los lomos de los libros antes de escanearlos, y el papel sobrante terminaba reciclado en cajas y papel higiénico

Anthropic desarrolló en secreto el Proyecto Panama para escanear de forma destructiva millones de libros y entrenar a su chatbot Claude. (Reuters)
Anthropic desarrolló en secreto el Proyecto Panama para escanear de forma destructiva millones de libros y entrenar a su chatbot Claude. (Reuters)
Guardar

En algún almacén de Estados Unidos, máquinas hidráulicas cortaban lomos de libros para después escanear su contenido con equipos de imagen industriales. Documentos judiciales recién desclasificados revelan que Anthropic, la empresa detrás del chatbot Claude, compró, destruyó y escaneó en secreto millones de libros para entrenar su inteligencia artificial, en una operación interna bautizada como Proyecto Panama.

El plan, descrito en un documento interno de planificación que salió a la luz en escritos judiciales a finales de julio, tenía como objetivo “escanear de forma destructiva todos los libros del mundo”. El propio texto advertía sobre la necesidad de discreción: “No queremos que se sepa que estamos trabajando en esto”. La revelación, adelantada por The Washington Post, expuso el trato que una de las mayores empresas de inteligencia artificial del mundo da al trabajo de escritores, artistas y otros creadores.

PUBLICIDAD

Cómo operaba el Proyecto Panama

La iniciativa comenzó a principios de 2024, cuando directivos de Anthropic buscaban libros anteriores a los ya disponibles en internet que pudieran enseñar a Claude “a escribir bien” en lugar de imitar “la jerga de internet de baja calidad”, según los documentos judiciales.

Un grupo de autores, encabezado por la novelista Andrea Bartz, demandó a Anthropic por el uso ilegal de sus obras para entrenar a Claude. (Reuters)
Un grupo de autores, encabezado por la novelista Andrea Bartz, demandó a Anthropic por el uso ilegal de sus obras para entrenar a Claude. (Reuters)

La compañía adquirió decenas de miles de ejemplares de una sola vez a proveedores como Better World Books y World of Books, esta última con sede en Reino Unido. Después externalizó el proceso de escaneo y destrucción a un tercero, que utilizaba una máquina hidráulica para cortar los lomos y separar las páginas una a una, de modo que pudieran copiarse y cargarse con rapidez.

PUBLICIDAD

Uno de los proveedores que finalmente trabajó con la empresa señaló que esta buscaba a alguien capaz de convertir de 500.000 a dos millones de libros en un plazo de seis meses. Tras el escaneo, el papel se convertía en residuo destinado a plantas de reciclaje, donde se transformaba en productos como papel higiénico y cajas de cartón.

Los documentos internos sugieren que los directivos de Anthropic creían que el uso de libros mejoraría la calidad de la comunicación de Claude y ayudaría a evitar el llamado colapso de los modelos de inteligencia artificial, un fenómeno de degradación que ocurre cuando un sistema se entrena con textos ya contaminados por producción generada por IA.

Un documento interno de la compañía advertía: "No queremos que se sepa que estamos trabajando en esto". (Europa Press)
Un documento interno de la compañía advertía: "No queremos que se sepa que estamos trabajando en esto". (Europa Press)

A diferencia de buena parte de la web moderna, los libros ofrecen grandes volúmenes de literatura escrita por personas y editada de forma profesional, todavía sin la interferencia de contenidos generados por máquinas. El reto para la empresa era cómo conseguir ese material a gran escala, y los documentos judiciales indican que sus directivos pudieron confiar en que la maniobra pasaría inadvertida o, en su defecto, en que el resultado final justificaría el método.

Según uno de los escritos presentados ante el tribunal, el cofundador de Anthropic, Ben Mann, obtuvo en junio de 2021 una colección de contenido protegido por derechos de autor procedente de una “biblioteca en la sombra” llamada LibGen. El documento incluye incluso una captura de pantalla del navegador de Mann mientras descargaba los libros.

Un año después, Mann compartió con otros empleados de la empresa un enlace a Pirate Library Mirror, un catálogo de libros obtenidos de forma ilegal, con el mensaje: “Justo a tiempo!!!”.

El cofundador de Anthropic, Ben Mann, obtuvo en 2021 contenido protegido por derechos de autor a través de la biblioteca en la sombra LibGen. (Reuters)
El cofundador de Anthropic, Ben Mann, obtuvo en 2021 contenido protegido por derechos de autor a través de la biblioteca en la sombra LibGen. (Reuters)

La demanda que destapó el proyecto secreto

Proyecto Panama solo se conoció públicamente por miles de páginas de documentación desclasificada en una demanda colectiva por derechos de autor. En 2024, un grupo de autores encabezado por la novelista Andrea Bartz y los escritores de no ficción Charles Graeber y Kirk Wallace Johnson presentó la acción legal, en la que acusaba a Anthropic de usar de manera ilegal sus obras para entrenar a Claude.

El mes pasado, la empresa, valorada actualmente en 965.000 millones de dólares (875.000 millones de euros), aceptó pagar 1.500 millones de dólares (unos 1.300 millones de euros) para resolver el caso, una cifra que cubre alrededor de 500.000 obras elegibles. “Es la mayor indemnización conocida por vulneración de derechos de autor de la historia”, afirmó Justin Nelson, abogado principal de los autores.

El acuerdo constituye el primero de una serie de demandas contra empresas de inteligencia artificial que llega a una resolución de este tipo. Meta, OpenAI, Google y Microsoft enfrentan litigios similares por parte de autores que denuncian prácticas de piratería equivalentes, mientras que varios escritores que no se sumaron al acuerdo colectivo mantienen causas individuales abiertas contra Anthropic.

Anthropic aceptó pagar 1.500 millones de dólares para resolver la demanda, la mayor indemnización conocida por vulneración de derechos de autor. (AP)
Anthropic aceptó pagar 1.500 millones de dólares para resolver la demanda, la mayor indemnización conocida por vulneración de derechos de autor. (AP)

Qué dejó la resolución judicial

El fallo original, dictado el año pasado, estableció que el uso de libros adquiridos de forma legal por parte de la empresa estaba protegido como uso legítimo bajo la legislación estadounidense, aunque marcó una distinción respecto de los millones de ejemplares que la compañía había pirateado con anterioridad.

“La histórica resolución de junio de 2025 del tribunal sigue intacta”, declaró la subdirectora jurídica de Anthropic, Aparna Sridhar, en un comunicado recogido por The Washington Post. “La cuestión sobre la que hemos llegado a un acuerdo tiene que ver con la forma en que se adquirieron algunos materiales, no con si podíamos utilizarlos para desarrollar inteligencia artificial”, agregó.

Mientras otros procesos judiciales siguen su curso, los documentos desclasificados sobre Proyecto Panama quedan como testimonio del método con el que una de las principales compañías del sector obtuvo parte del material que alimentó el entrenamiento de su tecnología.

PUBLICIDAD

PUBLICIDAD