Por qué Anthropic destruyó millones de libros para entrenar su inteligencia artificial
En algún almacén de Estados Unidos, máquinas hidráulicas cortaban lomos de libros para después escanear su contenido con equipos de imagen industriales.
Documentos judiciales recién desclasificados revelan que Anthropic , la empresa detrás del chatbot Claude , compró, destruyó y escaneó en secreto millones de libros para entrenar su inteligencia artificial, en una operación interna bautizada como Proyecto Panama.
El plan, descrito en un documento interno de planificación que salió a la luz en escritos judiciales a finales de julio, tenía como objetivo “escanear de forma destructiva todos los libros del mundo” .
El propio texto advertía sobre la necesidad de discreción: “No queremos que se sepa que estamos trabajando en esto”.
La revelación, adelantada por The Washington Post, expuso el trato que una de las mayores empresas de inteligencia artificial del mundo da al trabajo de escritores, artistas y otros creadores.
Cómo operaba el Proyecto Panama La iniciativa comenzó a principios de 2024, cuando directivos de Anthropic buscaban libros anteriores a los ya disponibles en internet que pudieran enseñar a Claude “a escribir bien” en lugar de imitar “la jerga de internet de baja calidad”, según los documentos judiciales.
La compañía adquirió decenas de miles de ejemplares de una sola vez a proveedores como Better World Books y World of Books , esta última con sede en Reino Unido.
Después externalizó el proceso de escaneo y destrucción a un tercero, que utilizaba una máquina hidráulica para cortar los lomos y separar las páginas una a una, de modo que pudieran copiarse y cargarse con rapidez.
Uno de los proveedores que finalmente trabajó con la empresa señaló que esta buscaba a alguien capaz de convertir de 500.000 a dos millones de libros en un plazo de seis meses .
Tras el escaneo, el papel se convertía en residuo destinado a plantas de reciclaje, donde se transformaba en productos como papel higiénico y cajas de cartón.
Los documentos internos sugieren que los directivos de Anthropic creían que el uso de libros mejoraría la calidad de la comunicación de Claude y ayudaría a evitar el llamado colapso de los modelos de inteligencia artificial , un fenómeno de degradación que ocurre cuando un sistema se entrena con textos ya contaminados por producción generada por IA.
A diferencia de buena parte de la web moderna, los libros ofrecen grandes volúmenes de literatura escrita por personas y editada de forma profesional, todavía sin la interferencia de contenidos generados por máquinas.
El reto para la empresa era cómo conseguir ese material a gran escala, y los documentos judiciales indican que sus directivos pudieron confiar en que la maniobra pasaría inadvertida o, en su defecto, en que el resultado final justificaría el método.
5News agregó este resumen a partir del feed público del medio. La nota completa, con todo el contexto, está en www.infobae.com — el contenido pertenece a Infobae (Tecno).