IA devora libros físicos: la carrera por datos humanos no contaminados

La carrera por el desarrollo de la inteligencia artificial ha dado un giro inesperado que trasciende lo digital: las grandes compañías tecnológicas están adquiriendo masivamente libros de segunda mano, especialmente ejemplares de no ficción descatalogados, para alimentar sus modelos de lenguaje. Este proceso no busca la preservación, sino la obtención de datos humanos puros, libres de la "contaminación" generada por la propia IA en internet.

Montaña de libros antiguos

La estrategia detrás de la destrucción masiva

Libreros de todo el mundo han detectado un patrón inusual: compradores que adquieren miles de ejemplares sin importar el valor de mercado ni la coherencia temática. Empresas como ZoomBooks o plataformas como ISBNdb actúan como intermediarios, facilitando el acceso a estos textos a laboratorios de IA. La clave de esta operativa reside en una interpretación legal del fair use: para que la digitalización y el entrenamiento sean considerados un uso transformador legal, el ejemplar físico debe ser destruido tras su escaneo, evitando así la duplicidad de copias.

Librería de viejo

El valor del texto no contaminado

El auge de este mercado responde a la necesidad crítica de las empresas de IA de obtener material original, impreso antes de 2022, antes de que el volumen de contenido generado automáticamente inundara la red. Documentos internos, como los vinculados al llamado Project Panama de Anthropic, revelan que el objetivo es escanear sistemáticamente el conocimiento humano impreso. Mientras las compañías tecnológicas priorizan la confidencialidad en sus acuerdos, los sectores culturales denuncian esta práctica como un expolio literario que pone en riesgo el patrimonio bibliográfico local, desde fanzines hasta documentación histórica de movimientos sociales.

Almacén de libros

forum Comentarios

forum

No hay comentarios aún. ¡Sé el primero en opinar!

© Copyright 2026 GNews Todos los derechos reservados . Editado por Aby