虎嗅

Les entreprises de la Silicon Valley commencent à éliminer les déchets générés par l'intelligence artificielle

原文:硅谷公司开始清理AI垃圾

Résumé des principaux points

Le contenu généré par l’IA, tel que des recettes sans sens, des biographies frauduleuses ou des images et vidéos étranges, a envahi les principales plateformes comme Google, Amazon et Facebook, polluant ainsi l’environnement informationnel en ligne. Les entreprises technologiques de la Silicon Valley (Spotify, YouTube, LinkedIn, etc.) commencent enfin à nettoyer ces déchets sur une grande échelle, mais elles rencontrent de nombreux problèmes : beaucoup de ces entreprises ont contribué à la prolifération de ce contenu grâce à leurs outils d’IA. Le processus de nettoyage peut endommager les créateurs légitimes, et la définition même de ce contenu considéré comme “déchet” ainsi que sa gestion constituent un défi systémique qui ne peut pas être résolu simplement par la suppression.

I. À quel point le contenu généré par l’IA est-il répandu ?

Des exemples concrets illustrent l’ampleur du problème :

  • Lorsque vous recherchez des recettes sur Google, vous obtenez parfois des résultats absurdes comme la “pizza au colle” ;
  • Les biographies vendues sur Amazon pourraient être des contenus fabriqués par l’IA ;
  • Sur Facebook, vous pouvez tomber sur des images sans signification, comme celle de “Jésus aux crevettes”.

Les données sont encore plus alarmantes :

  • Spotify a supprimé 75 millions de pistes musicales inutiles l’an passé (chargées en masse ou répétitives), représentant une partie importante de sa bibliothèque ;
  • YouTube a fermé 130 000 chaînes à faible qualité créées par l’IA au cours des six premiers mois de l’année ;
  • Près de la moitié des nouveaux morceaux téléchargés sur Deezer sont générés par l’IA, et beaucoup n’ont jamais été écoutés ;
  • Un tiers du contenu téléchargé sur Apple Music est également produit par l’IA ;
  • Sur X (anciennement Twitter), près de la moitié des posts de plus de 50 mots sont écrits par l’IA.

Même le dictionnaire Merriam-Webster a désigné “le contenu généré par l’IA” comme le mot de l’année 2025, ce qui montre à quel point le problème est sérieux.

II. Pourquoi les entreprises de la Silicon Valley agissent-elles seulement maintenant ?

Les utilisateurs ne supportent plus, et les plateformes ne peuvent plus continuer ainsi :

  • Les utilisateurs sont de plus en plus mécontents : ils se retrouvent face à des titres de mauvaise qualité et ne trouvent pas le contenu qu’ils cherchent ; par exemple, la flux d’informations vidéo créé par l’IA sur Meta a été critiqué comme une “exposition de déchets” ;
  • Les plateformes sont sous pression : le contenu inutile occupe trop d’espace et éclipsé les contenus de qualité ; par exemple, 20 % des vidéos recommandées aux nouveaux utilisateurs sur YouTube sont générées par l’IA, et certaines chaînes à contenu dégradé peuvent générer jusqu’à 4,25 millions de revenus par an, forçant les plateformes à suspendre leurs activités lucratives ;
  • L’opinion publique a changé : les experts affirment que laisser proliférer ce contenu peut “étouffer la créativité humaine et corrompre la culture” ; les utilisateurs se plaignent de ne pas pouvoir distinguer le vrai du faux en ligne, et les plateformes risquent de perdre des utilisateurs si elles n’agissent pas.

III. Quelles mesures prennent les plateformes pour nettoyer ?

Les méthodes de nettoyage varient d’une plateforme à l’autre :

  • Suppression directe : Spotify supprime les pistes musicales répétitives, YouTube ferme les chaînes à faible qualité ; TikTok a supprimé 377 000 vidéos générées par l’IA au cours des trois premiers mois de l’année ;
  • Participation des utilisateurs : LinkedIn a ajouté des boutons pour signaler le contenu généré par l’IA, Pinterest et TikTok permettent aux utilisateurs de choisir de limiter leur exposition à ce type de contenu ;
  • Contre-mesures basées sur l’IA : YouTube utilise l’IA pour analyser la vitesse de chargement des vidéos et les modèles répétitifs afin de détecter les comptes générés par l’IA ; Substack utilise des outils d’IA pour vérifier si les articles longs sont écrits par des humains ;
  • Restricitions sur les revenus : X a banni les applications qui utilisent des robots pour publier du contenu dégradé, et YouTube a suspendu la capacité de certaines chaînes à générer des revenus.

IV. Le nettoyage n’est pas si simple : risques d’endommager les créateurs légitimes, définition floue, et double standard des plateformes

Le processus de nettoyage présente de nombreux obstacles :

  • Endommagement des créateurs légitimes : YouTube peut supprimer par erreur des créateurs qui publient du contenu de qualité en se basant sur des critères comme la vitesse de chargement ou l’utilisation de modèles répétitifs ; les outils d’IA de Substack peuvent confondre des articles écrits par des humains avec du contenu généré par l’IA, obligeant les auteurs à se défendre ;
  • Définition floue : tout le contenu généré par l’IA n’est pas considéré comme dégradé ; par exemple, les articles aidés par l’IA doivent-ils être classés comme tels ? Les plateformes ont du mal à établir des critères clairs ;
  • Double standard des plateformes : de nombreuses entreprises qui nettoient ce contenu ont elles-mêmes contribué à sa prolifération en utilisant des outils d’IA ; par exemple, Meta a promis de lutter contre ce problème tout en lançant des générateurs d’images qui abusaient des données des utilisateurs, avant de retirer ces fonctionnalités suite aux critiques.

V. Avertissement des experts : il s’agit d’un problème systémique

Selon des experts de l’Université Columbia, le contenu généré par l’IA n’est pas simplement un “type de contenu dégradé”, mais fait partie d’un problème plus large concernant l’environnement informationnel :

  • L’IA est une arme à double tranchant : les plateformes en profitent pour augmenter la participation des utilisateurs, mais le contenu inutile généré par l’IA les entrave également ;
  • Il n’est pas possible de résoudre le problème de manière simpliste ; l’IA est un outil de création, et les créations légitimes assistées par l’IA ne devraient pas être pénalisées ;
  • Si les plateformes ne gèrent pas correctement la situation, elles risquent de perdre des utilisateurs : ceux-ci se tourneront vers d’autres services si ils ne trouvent pas de contenu de qualité.

En somme, le nettoyage du contenu généré par l’IA n’est pas une tâche facile ; il faut s’attaquer aux mécanismes de motivation des plateformes (comme la dépendance aux clics) et trouver un équilibre entre la créativité offerte par l’IA et ses effets négatifs.

Cette nouvelle nous montre que, bien que l’IA apporte des facilités, elle génère également de nouveaux problèmes. Les plateformes commencent enfin à reconnaître ces problèmes, mais il reste beaucoup à faire. Les utilisateurs doivent également être vigilants en ligne et éviter d’être trompés par ce contenu de qualité médiocre.