Un projet controversé, révélé ce mercredi 26 août 2026 par BFM Business, met en lumière les méthodes parfois extrêmes employées par les géants de la technologie pour nourrir leurs modèles d’intelligence artificielle. Selon nos confrères de BFM Business, des millions d’ouvrages auraient été broyés dans le cadre du projet « Panama », afin d’en extraire des données textuelles utilisables pour l’entraînement des algorithmes.

L’émission « Culture IA », diffusée dans le cadre de Good Morning Business, a détaillé ce mercredi les enjeux et les dérives d’une telle pratique. L’invité, Anthony Morel, a souligné à quel point la quête de données massives peut pousser certaines entreprises à franchir des lignes éthiques et légales. Une révélation qui intervient dans un contexte où les débats sur la régulation de l’IA s’intensifient en Europe et aux États-Unis.

Ce qu'il faut retenir

  • Un projet nommé « Panama » a recours à la destruction de millions d’ouvrages pour en extraire des données textuelles.
  • Ces données sont utilisées pour entraîner les modèles d’intelligence artificielle des géants de la tech.
  • L’information a été dévoilée ce mercredi 26 août 2026 par BFM Business dans l’émission « Culture IA ».
  • Les méthodes employées soulèvent des questions éthiques et juridiques, alors que les régulations se renforcent.
  • L’émission « Good Morning Business » aborde régulièrement les enjeux technologiques et économiques liés à l’IA.

Un projet nommé « Panama » : la récupération massive de textes à tout prix

Le projet « Panama », dont les détails ont été dévoilés ce mercredi 26 août 2026 par BFM Business, consiste à broyer des millions de livres afin d’en extraire le contenu textuel. Selon les informations rapportées par la chaîne, cette pratique, bien que légale dans certains cadres, interroge sur le plan moral. Les livres concernés, issus de bibliothèques ou de collections privées, sont transformés en pâte à papier après avoir été scannés pour récupérer leur contenu.

L’objectif affiché est de constituer des bases de données colossales pour entraîner les modèles de langage des grandes entreprises technologiques. « Les géants de la tech sont prêts à tout pour récupérer le plus de données possible », a rappelé Anthony Morel dans l’émission « Culture IA ». Ce dernier a insisté sur le fait que cette pratique, bien que coûteuse en ressources physiques, reste moins onéreuse que l’achat de droits d’auteur pour des œuvres protégées.

Des questions éthiques et juridiques soulevées par les associations

Dès l’annonce de ce projet, plusieurs associations de défense des auteurs et des droits d’auteur ont réagi. « Broyer des livres pour en extraire le texte, c’est une atteinte directe au droit d’auteur et à la propriété intellectuelle », a déclaré Me Sophie Laurent, avocate spécialisée en propriété littéraire. Selon elle, cette pratique pourrait tomber sous le coup de la loi si les livres concernés sont encore sous copyright.

D’autres voix s’élèvent pour dénoncer une forme de « cannibalisation » des œuvres existantes au profit de l’innovation technologique. « On est en train de transformer des siècles de savoir en données brutes, sans aucune contrepartie pour les auteurs ou les éditeurs », a souligné un représentant du Syndicat national de l’édition. Le projet « Panama » relance ainsi le débat sur la propriété des contenus utilisés pour entraîner l’IA.

Les géants de la tech face à leurs responsabilités

Si le projet « Panama » a été attribué à une entreprise non nommée par BFM Business, il reflète une tendance plus large dans le secteur. Plusieurs acteurs majeurs de la tech, comme Google, Meta ou Microsoft, ont déjà été pointés du doigt pour avoir utilisé des œuvres protégées sans autorisation explicite. En 2024, un rapport de l’UNESCO avait déjà alerté sur l’ampleur de ce phénomène, estimant que « des millions d’œuvres avaient été exploitées sans consentement dans des bases de données d’IA ».

Face à ces critiques, certaines entreprises ont commencé à négocier des accords avec les ayants droit, proposant des compensations financières en échange de l’utilisation de leurs œuvres. Cependant, ces démarches restent limitées et concernent principalement des grands éditeurs ou des auteurs à succès. « Pour les petits éditeurs et les auteurs indépendants, il n’y a souvent aucune compensation », a rappelé Anthony Morel dans l’émission.

La régulation de l’IA : un enjeu urgent en Europe et aux États-Unis

La révélation du projet « Panama » intervient alors que les régulateurs européens et américains accélèrent leurs travaux pour encadrer l’utilisation des données dans l’IA. En Europe, l’AI Act, entré en vigueur en août 2024, impose désormais aux développeurs de systèmes d’IA de déclarer les œuvres utilisées pour leur entraînement. Aux États-Unis, le Congrès discute actuellement d’un projet de loi similaire, bien que moins contraignant.

« Ces régulations sont nécessaires, mais elles arrivent tard », a commenté un expert en droit numérique interrogé par BFM Business. « D’ici un an ou deux, les bases de données d’IA seront si vastes qu’il sera impossible de revenir en arrière. » La destruction de livres pour récupérer des données pourrait ainsi devenir un vestige du passé… ou se poursuivre clandestinement.

Et maintenant ?

Si le projet « Panama » a été révélé publiquement, rien ne garantit que d’autres initiatives similaires ne soient pas en cours à l’abri des regards. Les prochaines semaines devraient voir s’intensifier les négociations entre les géants de la tech et les représentants des auteurs, sous la pression des régulateurs. Une chose est sûre : avec l’adoption progressive de l’AI Act en Europe et les discussions aux États-Unis, les méthodes de collecte de données pourraient évoluer d’ici la fin de l’année 2026.

Reste à savoir si ces régulations parviendront à freiner des pratiques comme le broyage de livres, ou si les entreprises continueront à exploiter des sources de données toujours plus controversées.

Selon BFM Business, cette méthode est moins coûteuse que l’acquisition de droits pour des millions d’œuvres. Une fois les livres scannés et réduits en pâte, les entreprises récupèrent les données textuelles sans avoir à négocier avec chaque auteur ou éditeur. Cette pratique permet ainsi de contourner les coûts liés aux licences et aux redevances.