Cultura Section

Anthropic destruyó millones de libros con los que alimentó su IA

Agencias DIARIO DE TABASCO
01/09/2026 | 10:20:10

Un juez en EU hizo públicos más de 4 mil páginas de una demanda por derechos de autor. Especialistas de la UNAM advierten que el uso de obras protegidas sigue en un vacío legal.

En 2024, la empresa de inteligencia artificial Anthropic puso en marcha una estrategia para adquirir millones de libros, deshojarlos, escanearlos y usar su contenido para alimentar modelos de IA.

Los detalles de esa iniciativa, conocida como Proyecto Panamá, se mantuvieron en secreto hasta que un juez de distrito en Estados Unidos hizo públicos más de 4 mil páginas de documentos de una demanda por derechos de autor.

En entrevista con La Jornada, Ismael Everardo Bárcenas Patiño, responsable del Laboratorio de Inteligencia Artificial Microsoft de la UNAM, explicó que los modelos que sostienen a los chatbots necesitan grandes volúmenes de información para responder consultas de salud, educación y otros campos.

“Si lo entrenamos con un libro sobre medicina, todos esos datos se cargan en el modelo y entonces es capaz de utilizar esa información para inferir sobre alguna consulta”, señaló.

Rocío Aldeco Pérez, especialista en criptografía, cadena de bloques y sistemas distribuidos, consideró que el caso de Anthropic revela que, para entrenar IA, las compañías buscan fuentes más allá de lo que ya está en internet.

“Hay libros antiguos que nunca fueron digitalizados; entonces su información nunca se usó para ese entrenamiento. Recurrir a ellos es una manera de ver si esos datos mejorarían el modelo de aprendizaje que ya se tiene.”

Documentos legales revisados por The Washington Post indican que Anthropic también recurrió a sitios que distribuían contenidos sin respetar derechos de autor. Según esos registros, compró millones de libros usados, cortó los lomos para escanear las páginas y después envió los ejemplares a una empresa de reciclaje.

Ambos especialistas coincidieron en que, en medio de la competencia por desarrollar modelos de IA, uno de los principales dilemas es el uso de obras protegidas.

“Cuando escribes un libro esperas venderlo y ganar dinero para seguir escribiendo. Aquí se usa de maneras que no puedo decir ilegales, pero que tampoco son legales. Es algo que sucede en un espacio gris de la legislación”, afirmó Aldeco Pérez.

Bárcenas Patiño agregó que estos modelos, basados principalmente en redes neuronales, requieren mucha información para entrenarse y que, como eventualmente lucran, “sería pertinente evaluar si se tendría que pagar derecho de autor”.

El juez William Alsup dictaminó que Anthropic podía utilizar libros adquiridos legalmente para entrenar sus modelos, al considerar que el uso era transformador, y lo comparó con la forma en que un profesor enseña a escribir. Dejó abierta, sin embargo, la disputa sobre los ejemplares obtenidos de fuentes que infringían derechos de autor.

México, lejos de esa operación

Para Bárcenas Patiño, México está lejos de replicar un proyecto como Panamá, porque no cuenta con la infraestructura necesaria: centros de datos de alta potencia, equipo especializado y gran capacidad de cómputo.

Advirtió, no obstante, que el país sí tiene volúmenes de información que podrían interesar a empresas extranjeras: producción editorial, contenidos públicos en internet, datos que generan los usuarios en plataformas y registros gubernamentales de acceso abierto.

Ambos especialistas coincidieron en que México debe apostar por desarrollar tecnología propia y crear una regulación que fije límites claros para el uso de obras y datos en el entrenamiento de modelos de inteligencia artificial.

“Cómo vamos a legislar y cómo vamos a proteger la soberanía de nuestros países frente a esta situación son las conversaciones que debemos dar en universidades, empresas y gobierno”, concluyó Aldeco Pérez.

Con información de La Jornada

COMPARTE ESTA NOTA