Anthropic y Amazon también bajo sospecha por prácticas similares de destrucción de libros
Organizaciones de la sociedad civil estadounidense han exhortado a la Comisión Federal de Comercio (FTC) a investigar la práctica de las grandes tecnológicas de comprar masivamente libros para entrenar sistemas de inteligencia artificial, escanearlos y luego destruir los originales.
Dieciocho instituciones, entre ellas el Fondo de Educación Demand Progress y la Alianza de Consumidores de Estados Unidos (CFA), enviaron una carta conjunta el 21 de agosto al presidente de la FTC, Andrew Ferguson, y al comisionado Mark Meador, solicitando que investiguen si las prácticas de compra y destrucción de libros por parte de empresas de IA constituyen competencia desleal, según reportó la agencia Yonhap el 22 de agosto.
Los grupos argumentan que cuando las empresas de IA compran grandes cantidades de libros de papel, los escanean y destruyen permanentemente los originales, están bloqueando el acceso a esos recursos para impedir que la competencia obtenga materiales idénticos.
En particular, señalaron que esto constituye un caso de «bloqueo de fuentes de suministro» que dificulta la entrada al mercado de nuevas startups de IA, y enfatizaron que la FTC debe aplicar las disposiciones legales federales contra la competencia desleal para investigar estas prácticas.
En la carta conjunta, las organizaciones criticaron que al destruir permanentemente grandes cantidades de libros, las empresas de IA están bloqueando el acceso público a estos materiales, lo que ha permitido que «solo las empresas establecidas más grandes construyan modelos de IA de alta calidad».
También argumentaron que al eliminar los originales de obras protegidas, se está creando un futuro en el que solo ciertas empresas tendrán el monopolio del registro histórico de la humanidad. Señalaron que dado que muchos de los libros utilizados para entrenar IA fueron publicados antes del auge de la IA generativa, estos materiales deben considerarse como recursos finitos y escasos de la humanidad.
De hecho, se sabe que algunas grandes tecnológicas han estado adquiriendo datos de entrenamiento para IA mediante estas prácticas.
Anthropic construyó su base de datos de entrenamiento de IA a través del denominado «Proyecto Panamá», mediante el cual compró millones de libros, cortó los lomos, los escaneó y luego reciclaba los libros destruidos como papel de desecho.
También se sabe que Amazon entrena sus modelos de IA de manera similar. El periódico británico The Guardian reportó recientemente casos de compras masivas de libros usados seleccionados aparentemente por máquinas en librerías de segunda mano de América del Norte, Europa y Australia.
El medio especializado en tecnología 404Media informó que después de colocar dispositivos de seguimiento en mil libros de una compra al por mayor recibida por una librería, verificó que esos libros fueron dirigidos a una instalación de escaneo de libros en un almacén logístico de Amazon en Las Vegas, Nevada.
Esta controversia se ha extendido más allá del tema de derechos de autor en el entrenamiento de IA, llegando ahora a cuestiones sobre la equidad de la competencia entre empresas de IA.
Antes, un tribunal federal estadounidense falló en un pleito de derechos de autor presentado por autores contra Anthropic que el uso de libros legalmente adquiridos para entrenar IA constituye un «uso justo» y no viola la ley de derechos de autor. Sin embargo, los grupos ciudadanos sostienen que incluso si no hay infracción de derechos de autor, la práctica de comprar y destruir libros podría constituir competencia desleal.
Anthropic resolvió anteriormente una demanda de derechos de autor con autores llegando a un acuerdo por 1.500 millones de dólares, conocido como el mayor acuerdo en la historia de litigios de derechos de autor estadounidenses, cerrando el caso el mes pasado.
* Este artículo ha sido traducido por IA.
