Une étude choc menée par le Tow Center for Digital Journalism a mis au jour une faille majeure des moteurs de recherche dopés à l’IA : ils sont très mauvais pour citer correctement les articles d’actualité. Après avoir analysé huit plateformes de recherche basées sur l’IA, les chercheurs ont constaté que plus de 60 % des réponses contenaient des citations incorrectes ou trompeuses. Certains chatbots d’IA s’en sortaient mieux que d’autres — Perplexity affichait un taux d’erreur de 37 % —, mais le Grok 3 d’Elon Musk était le plus mauvais élève, produisant des citations incorrectes dans 94 % des cas, un chiffre stupéfiant.
Le chaos des citations de l’IA
De nombreux moteurs de recherche et chatbots basés sur l’IA, comme ChatGPT et Grok, citent des sources d’information traditionnelles comme la BBC, The New York Times ou Reuters pour renforcer leur crédibilité. La logique est la suivante : si le chatbot renvoie vers une publication reconnue, l’utilisateur est plus susceptible de croire la réponse.
Mais l’étude a révélé que bon nombre de ces citations ne renvoient pas réellement au contenu original ; elles fabriquent plutôt des liens, citent des articles syndiqués ou plagiés, ou attribuent des articles à tort à d’autres éditeurs. Lorsque ces citations sont incorrectes, la réputation du chatbot comme celle des éditeurs est entachée.
Plus grave encore : les utilisateurs qui ne vérifient pas les sources peuvent, sans le savoir, propager la désinformation, renforçant ainsi les inexactitudes du chatbot.
Les chatbots d’IA et l’accès aux contenus restreints
Outre les problèmes de citation, l’étude a mis au jour des incohérences préoccupantes dans la manière dont les chatbots d’IA gèrent les contenus restreints. Certains chatbots, notamment ChatGPT et Perplexity, n’ont pas réussi à répondre à des requêtes concernant des éditeurs qui autorisaient explicitement l’accès des robots d’exploration, ou ont répondu avec succès à des questions sur des contenus auxquels ils n’auraient pas dû pouvoir accéder. Perplexity Pro a correctement identifié près d’un tiers des 90 extraits d’articles qui auraient dû lui être inaccessibles.
L’une des découvertes les plus alarmantes est que la version gratuite de Perplexity a répondu correctement aux 10 requêtes portant sur des articles de National Geographic protégés par un paywall, alors même que National Geographic a explicitement interdit l’accès à ses robots d’exploration. Si les modèles d’IA peuvent parfois déduire des informations à partir de références accessibles au public, ce constat soulève des questions quant au respect par Perplexity des restrictions imposées par les éditeurs, comme elle s’y est engagée.
Press Gazette a rapporté que Perplexity avait fait référence à du contenu du New York Times à 146 000 reprises en janvier, malgré le blocage de ses robots d’exploration par l’éditeur. De son côté, ChatGPT, bien qu’ayant répondu à moins de questions sur des contenus restreints que les autres chatbots, a tout de même montré une tendance à fournir des informations incorrectes plutôt qu’à simplement refuser de répondre.
Le problème de l’excès de confiance de l’IA
L’un des principaux défauts de l’IA est sa confiance inébranlable — même lorsqu’elle se trompe. Les moteurs de recherche basés sur l’IA admettent rarement ne pas savoir quelque chose ; ils comblent plutôt les lacunes avec des réponses incorrectes, mais formulées sur un ton autoritaire. Cet effet d’« hallucination » rend difficile la détection de la désinformation par les utilisateurs, surtout lorsqu’ils ne connaissent pas bien le sujet.
Pourquoi la supervision humaine est plus importante que jamais
Alors que les moteurs de recherche basés sur l’IA peinent encore à fournir des résultats exacts, le jugement humain reste essentiel. Vérifier les faits, recouper les sources et faire preuve d’esprit critique sont autant de démarches nécessaires pour distinguer le vrai du faux. Tant que les plateformes d’IA n’auront pas considérablement amélioré la fiabilité de leurs sources, les utilisateurs devront rester sceptiques face aux citations générées par l’IA. Lisez l’intégralité de l’étude du Tow Center pour en savoir plus sur ses conclusions.
En savoir plus sur les risques liés à l’utilisation de l’IA générative et les mesures que vous pouvez prendre pour les limiter.

