Intelligence artificielle · Actualité

Pourquoi l'IA achète des livres au Japon : les ventes augmentent jusqu'à cinq fois Les achats de livres par l'intelligence artificielle (IA) ont connu une croissance significative au cours des dernières années, avec des chiffres qui montrent que les ventes peuvent augmenter jusqu'à cinq fois. Ce phénomène est particulièrement visible au Japon, où l

Dès août 2026, les librairies d'occasion au Japon enregistrent un phénomène inédit : des commandes massives qui multiplient par cinq leurs ventes quotidiennes. Derrière cette prospérité inattendue se cache un soupçon répandu parmi les libraires : ces ouvrages ne sont pas destinés à des lecteurs humains, mais à l'industrie de l'entraînement de l'intelligence artificielle.

Le plus concret émane d'un schéma logistique. Bien que les commandes proviennent de multiples comptes et de différentes boutiques, elles convergent toutes vers une même destination : un centre de distribution dans la préfecture d'Okayama, selon les documents de NTV Japon.

Que se passe-t-il dans les librairies japonaises

Le changement ne concerne pas seulement le volume, mais aussi le contenu. Un libraire de Tokyo a expliqué qu'auparavant, ce sont les romans et les mangas qui s'arrachaient ; maintenant, des sections entières de philosophie, d'histoire politique, de médecine, de droit et de livres sur la « vie et la culture de l'époque Edo » disparaissent.

Un vendeur de la région de Kanto soupçonne que les achats sont effectués par un programme automatisé, étant donné que les commandes arrivent à intervalles réguliers. Une libraire de l'ouest du pays a également reçu un courriel d'une entreprise étrangère demandant s'il pouvait fournir une commande de dizaines de milliers de livres.

La piste traverse le Pacifique. Une enquête basée sur des données d'exportation analysées à l'aide de l'outil Sayari a identifié plus de 50 tonnes de livres japonais envoyés aux États-Unis depuis 2025, soit l'équivalent d'environ 100 000 volumes. La destination finale, selon les médias américains, serait le découpage, le numérisation et la destruction de ces exemplaires pour alimenter les bases de données d'entraînement.

Pourquoi l'IA cherche des livres imprimés et non numériques

L'explication est technique, pas sentimentale. Depuis que les modèles de langage sont entraînés sur du texte généré par des modèles antérieurs, on observe ce qu'on appelle l'effondrement du modèle : la qualité du résultat se dégrade de génération en génération parce que le système finit par se nourrir de sa propre statistique.

Un livre imprimé avant 2022 résout ce problème car il garantit une autorité humaine antérieure à l'explosion des chatbots. Une analyse de la société Ahrefs portant sur environ 900 000 nouvelles pages web a révélé que 74,2 % contenaient déjà du contenu généré par l'IA en avril 2025.

Les livres d'occasion, non numérisés et non contaminés par des algorithmes, sont devenus la dernière grande réserve de texte humain disponible.

Cette logique explique pourquoi l'intelligence artificielle recourt aujourd'hui aux étagères physiques : les livres imprimés avant 2022 offrent un texte rédigé, édité et relu par des humains, sans contamination par du contenu généré par des machines, ce qui est de plus en plus rare sur Internet et précieux pour entraîner des modèles sans qu'ils se dégradent.

Comment s'effectuent l'achat et la numérisation destructive

Le précédent qui a documenté ce mécanisme sous un nom propre est Anthropic. Des documents judiciaires du cas Bartz c. Anthropic, déclassifiés en janvier 2026, ont révélé une opération interne baptisée « Project Panama », décrite comme l'effort pour « scanner destructivement tous les livres du monde ».

L'opération, dirigée par Tom Turvey, ancien responsable des alliances de Google Books, a engagé des prestataires utilisant des coupe-hydrauliques pour séparer les dos et faire passer les pages détachées sur des scanners haute vitesse. Le papier finissait recyclé, sans qu'il ne reste de copie physique.

Une enquête de 404 Media a apporté la confirmation la plus directe concernant une autre compagnie : elle a placé un traceur Apple AirTag dans une commande d'environ 1 000 livres suspects. L'appareil a voyagé jusqu'à un complexe logistique d'Amazon à Las Vegas, où des employés ont décrit la même procédure de coupe et de numérisation. « Tout ce que nous faisons ici, c'est scanner des livres », a écrit l'un des travailleurs sur un forum interne.

Quels problèmes génère cette tendance

Aux États-Unis, le juge William Alsup a statué en 2025 que la numérisation de livres achetés légalement, même si l'original est détruit, constitue un usage transformateur protégé par la doctrine du fair use. Cette même résolution a obligé Anthropic à payer 1,5 milliard de dollars pour avoir téléchargé plus de 7 millions de livres piratés, avec des compensations d'environ 3 000 dollars pour chacun des environ 482 000 titres concernés.

Le Japon présente un cadre différent. L'article 30-4 de sa loi sur la propriété intellectuelle permet, en principe, d'utiliser des œuvres protégées par le droit d'auteur pour « l'analyse d'informations » sans demander le consentement du titulaire, ce qui fait du pays un terrain attractif pour ce type d'opérations.

Face à ce vide juridique, 19 organisations du secteur de l'édition japonais, dont Kodansha et KADOKAWA, ont signé un communiqué conjoint exigeant le consentement, la transparence et un système d'autorisation préalable. Les libraires, quant à eux, mettent en garde contre un risque supplémentaire : si les volumes rares ou épuisés disparaissent après avoir été numérisés et détruits, des exemplaires uniques sans autre copie en circulation pourraient être perdus.