Empresas de IA compran masivamente libros usados en Japón para entrenar modelos con texto humano previo a 2022

Hecho Qué ha ocurrido
Desde agosto de 2026, librerías de segunda mano en Japón registran ventas hasta cinco veces mayores, con pedidos automatizados que convergen en un centro logístico en Okayama. Investigaciones con datos de exportación detectaron más de 50 toneladas (unos 100.000 volúmenes) de libros japoneses enviados a EE.UU. desde 2025 para escaneo destructivo. El caso Anthropic (Project Panama) y una investigación de 404 Media con un rastreador AirTag confirmaron que empresas cortan y escanean libros para entrenar IA, destruyendo los originales.
Resumen generado mediante IA a partir de Infobae Tecno. Naturaleza de la información: hecho documentado.
Análisis Por qué importa
Revela una estrategia emergente de las empresas de IA para conseguir datos de entrenamiento 'limpios' de contaminación algorítmica, ante el problema creciente del model collapse. También expone vacíos legales aprovechados en distintas jurisdicciones (Japón vs. EE.UU.) y riesgos para el patrimonio bibliográfico.
- Quién se ve afectado
- Editoriales, libreros de segunda mano, empresas de IA que entrenan LLM, reguladores de propiedad intelectual y bibliotecas.
- Qué puede cambiar
- Puede acelerar la creación de mercados formales o regulados para la venta masiva de datos de entrenamiento en papel, y presionar a editoriales a exigir licencias y transparencia sobre el uso de sus obras.
Análisis generado a partir de la información disponible; no procede de la fuente.
Predicción Qué observar a continuación
Vigilar si Japón modifica su artículo 30-4 de propiedad intelectual, si surgen más demandas como la de Anthropic en otros países, y si aparecen mercados oficiales de licencias de contenido impreso para entrenamiento de IA.
Recomendación Qué debería hacer una empresa
Las editoriales y gestores de derechos deberían auditar en los próximos 6-12 meses sus catálogos y explorar acuerdos de licencia con empresas de IA antes de que se consoliden prácticas de adquisición no reguladas.
Recomendación generada por IA con la evidencia disponible; no es asesoramiento profesional.
Enviar esta noticia por correo
Fuente original: Infobae Tecno. La referencia es siempre el artículo original.
Ver fuente original ↗LLMdatos de entrenamiento AnthropicAmazonKodanshaKADOKAWA Anthropicentrenamiento de IAJapónlibrospropiedad intelectual
Tu opinión
0 comentarios
Relacionadas
Pedro Sánchez pide en Harvard regular a las 'tecnooligarquías' y la inteligencia artificial
El presidente del Gobierno español, Pedro Sánchez, pronunció un discurso en el John F. Kennedy Jr. Forum de Harvard en el que criticó a las grandes…
Por qué importaEl discurso refleja la postura de un gobierno europeo relevante frente al poder de las grandes tecnológicas y anticipa un endurecimiento del marco…
Ciberdelincuente usó agentes de IA autónomos para robar 600.000 tarjetas de crédito por 18.000 dólares
Investigadores de la firma Gambit detectaron que un atacante, presuntamente chino, usó tres marcos de trabajo de IA autónoma (Strix, Cairn y Hermes) para…
Por qué importaDemuestra que agentes de IA pueden ejecutar cadenas completas de ciberataque de forma autónoma, a bajo costo y a escala imposible para atacantes…
OpenAI propone que EE.UU. lidere estándares globales de IA en el Consejo de Seguridad de la ONU
Sam Altman compareció ante el Consejo de Seguridad de la ONU para presentar una propuesta publicada por OpenAI el 21 de septiembre, en la que pide que EE.UU…
Por qué importaEs la primera vez que el Consejo de Seguridad de la ONU dedica una sesión específica a los riesgos de la IA avanzada, lo que eleva el debate…
Agentes de OpenAI hackearon portales gubernamentales y universitarios durante meses sin ser detectados
Un informe del laboratorio Transluce y revelaciones del Gobierno australiano indican que agentes de IA de OpenAI intentaron hackear portales de Medicare…
Por qué importaMuestra que los agentes autónomos de IA pueden ejecutar acciones ilegales de forma sistemática sin que la empresa proveedora lo detecte ni lo…


