La revelación de que Anthropic compró, cortó y escaneó millones de libros impresos para entrenar sus modelos de inteligencia artificial volvió a empujar esta semana un debate que ya no es solo legal, sino cultural. El caso se volvió visible de nuevo el 6 de agosto de 2026, cuando The Atlantic documentó compras masivas de títulos usados en varios países; el trasfondo estaba en documentos judiciales y reportajes previos sobre el proyecto interno con el que Anthropic digitalizó libros en Estados Unidos para alimentar a Claude, en busca de texto humano de alta calidad y libre de contaminación sintética.
De Project Panama al mercado mundial del libro usado
La pieza más concreta sigue siendo la documentación judicial. En la orden del 23 de junio de 2025 del caso Bartz v. Anthropic, el juez William Alsup dejó por escrito que la empresa “purchased millions of print copies” y destruyó cada ejemplar al reemplazarlo por una copia digital para su biblioteca central. Ese punto importa porque separa dos discusiones: por un lado, el uso de copias compradas y escaneadas; por otro, el uso de bibliotecas pirata como LibGen, que siguió bajo disputa y terminó en un acuerdo millonario.
La historia tomó forma pública el 27 de enero de 2026, cuando The Washington Post describió “Project Panama”, el plan interno con el que Anthropic buscó comprar libros por lotes, cortarles el lomo con maquinaria hidráulica, escanear las páginas y enviar el material sobrante a reciclaje. Según ese reporte, la compañía trabajó con vendedores como Better World Books y World of Books y apuntó a un volumen de entre 500.000 y 2 millones de libros en apenas seis meses. El mecanismo era brutalmente simple: comprar, desarmar, digitalizar, reciclar.
Lo que reactivó la conversación en agosto no fue solo la crudeza del método, sino el indicio de que el patrón puede haberse expandido más allá de un caso aislado. The Atlantic contó que librerías, intermediarios y plataformas de datos empezaron a detectar pedidos extraños de libros poco comunes, sobre todo no ficción de décadas pasadas. La lógica es comprensible para la industria: los modelos necesitan texto bien editado, extenso y anterior al boom de ChatGPT de 2022 para reducir el riesgo de entrenarse con contenido ya contaminado por IA.
Snopes pored over hundreds of pages of documents to confirm that Anthropic bought millions of books in bulk and destructively scanned them as part of an effort to train its AI model. The company specifically focused on "less common" and high-quality titles.
— snopes.com (@snopes) 9 de agosto de 2026
Traducción editorial: Snopes afirma, tras revisar documentos del caso, que Anthropic compró millones de libros y priorizó títulos menos comunes y de alta calidad para escanearlos de forma destructiva.
Por qué el caso importa más allá de Anthropic
La batalla de fondo no gira únicamente en torno a una empresa. Lo que observamos es un cambio en la economía de los datos: cuando la web abierta deja de ofrecer material suficientemente útil o limpio, el mercado busca reservas fuera de internet. Los libros impresos, sobre todo los publicados antes de 2022, ofrecen justamente eso. Para los laboratorios de frontera, son una materia prima con estilo, contexto y control editorial. Para autores, bibliotecas y libreros, son patrimonio, trabajo creativo y memoria cultural.
La resolución judicial de 2025 dio una señal incómoda para el sector editorial: entrenar un modelo con libros comprados y escaneados puede ser visto como uso transformador bajo la ley estadounidense, aunque el camino para conseguir otros títulos haya terminado en un acuerdo por 1.500 millones de dólares. Esa combinación deja una moraleja ambigua. La ley puede tolerar parte del proceso técnico mientras el malestar público crece por el modo en que se vacía el valor de los catálogos sin una negociación clara con quienes los escribieron, editaron o preservaron.
Para marketing, tecnología e IA, la noticia también expone un límite práctico del entusiasmo actual. La carrera por modelos más potentes ya no depende solo de chips y centros de datos; depende de encontrar material humano confiable en un internet cada vez más saturado de texto sintético. Por eso esta historia importa hoy. No habla solo de libros destruidos. Habla de qué está dispuesto a consumir el sector para seguir mejorando sus sistemas y de cuánto control conservarán los creadores sobre la materia prima que alimenta esa próxima generación.
- The Atlantic – Someone Is Mysteriously Snapping Up Used Books Around the World
- The Washington Post – Inside an AI start-up’s plan to scan and dispose of millions of books
- Bartz v. Anthropic – orden judicial del 23 de junio de 2025
- DW News – Why AI companies are destroying millions of books
- Tweet de Snopes sobre los documentos del caso