Le Grok 3 de Musk est « inexact à 94 % » : voici comment les autres chatbots d’IA se comportent face à la vérité

Elon Musk while on an interview on TED 2017.
Mar 13, 2025
3 minute read
eWeek content and product recommendations are editorially independent. We may make money when you click on links to our partners. Learn More

Une étude choc menée par le Tow Center for Digital Journalism a mis au jour une faille majeure des moteurs de recherche dopés à l’IA : ils sont très mauvais pour citer correctement les articles d’actualité. Après avoir analysé huit plateformes de recherche basées sur l’IA, les chercheurs ont constaté que plus de 60 % des réponses contenaient des citations incorrectes ou trompeuses. Certains chatbots d’IA s’en sortaient mieux que d’autres — Perplexity affichait un taux d’erreur de 37 % —, mais le Grok 3 d’Elon Musk était le plus mauvais élève, produisant des citations incorrectes dans 94 % des cas, un chiffre stupéfiant.

Le chaos des citations de l’IA

De nombreux moteurs de recherche et chatbots basés sur l’IA, comme ChatGPT et Grok, citent des sources d’information traditionnelles comme la BBC, The New York Times ou Reuters pour renforcer leur crédibilité. La logique est la suivante : si le chatbot renvoie vers une publication reconnue, l’utilisateur est plus susceptible de croire la réponse.

Mais l’étude a révélé que bon nombre de ces citations ne renvoient pas réellement au contenu original ; elles fabriquent plutôt des liens, citent des articles syndiqués ou plagiés, ou attribuent des articles à tort à d’autres éditeurs. Lorsque ces citations sont incorrectes, la réputation du chatbot comme celle des éditeurs est entachée.

Plus grave encore : les utilisateurs qui ne vérifient pas les sources peuvent, sans le savoir, propager la désinformation, renforçant ainsi les inexactitudes du chatbot.

Les chatbots d’IA et l’accès aux contenus restreints

Outre les problèmes de citation, l’étude a mis au jour des incohérences préoccupantes dans la manière dont les chatbots d’IA gèrent les contenus restreints. Certains chatbots, notamment ChatGPT et Perplexity, n’ont pas réussi à répondre à des requêtes concernant des éditeurs qui autorisaient explicitement l’accès des robots d’exploration, ou ont répondu avec succès à des questions sur des contenus auxquels ils n’auraient pas dû pouvoir accéder. Perplexity Pro a correctement identifié près d’un tiers des 90 extraits d’articles qui auraient dû lui être inaccessibles.

L’une des découvertes les plus alarmantes est que la version gratuite de Perplexity a répondu correctement aux 10 requêtes portant sur des articles de National Geographic protégés par un paywall, alors même que National Geographic a explicitement interdit l’accès à ses robots d’exploration. Si les modèles d’IA peuvent parfois déduire des informations à partir de références accessibles au public, ce constat soulève des questions quant au respect par Perplexity des restrictions imposées par les éditeurs, comme elle s’y est engagée.

Advertisement

Press Gazette a rapporté que Perplexity avait fait référence à du contenu du New York Times à 146 000 reprises en janvier, malgré le blocage de ses robots d’exploration par l’éditeur. De son côté, ChatGPT, bien qu’ayant répondu à moins de questions sur des contenus restreints que les autres chatbots, a tout de même montré une tendance à fournir des informations incorrectes plutôt qu’à simplement refuser de répondre.

Le problème de l’excès de confiance de l’IA

L’un des principaux défauts de l’IA est sa confiance inébranlable — même lorsqu’elle se trompe. Les moteurs de recherche basés sur l’IA admettent rarement ne pas savoir quelque chose ; ils comblent plutôt les lacunes avec des réponses incorrectes, mais formulées sur un ton autoritaire. Cet effet d’« hallucination » rend difficile la détection de la désinformation par les utilisateurs, surtout lorsqu’ils ne connaissent pas bien le sujet.

Pourquoi la supervision humaine est plus importante que jamais

Alors que les moteurs de recherche basés sur l’IA peinent encore à fournir des résultats exacts, le jugement humain reste essentiel. Vérifier les faits, recouper les sources et faire preuve d’esprit critique sont autant de démarches nécessaires pour distinguer le vrai du faux. Tant que les plateformes d’IA n’auront pas considérablement amélioré la fiabilité de leurs sources, les utilisateurs devront rester sceptiques face aux citations générées par l’IA. Lisez l’intégralité de l’étude du Tow Center pour en savoir plus sur ses conclusions.

En savoir plus sur les risques liés à l’utilisation de l’IA générative et les mesures que vous pouvez prendre pour les limiter.

Brittany Brooks

Brittany Brooks is a content writer with seven years of experience and has a passion for AI-driven innovation. For the past three years, she’s mastered AI-enabled tools and the art of prompt engineering to generate precise and impactful results. Alongside her writing, Brittany has developed strong skills in data analysis, leveraging AI to extract actionable insights and drive strategic decision-making. Obsessed with the intersection of AI and analytics, Brittany explores new ways to leverage AI to solve complex problems. As a self-proclaimed and proud tech geek, she embraces emerging technology and its future potential. When she’s not writing or analyzing data, you can find her in one of her many VR leagues, fully immersed in the next evolution of digital experiences.

eWeek Logo

eWeek has the latest technology news and analysis, buying guides, and product reviews for IT professionals and technology buyers. The site's focus is on innovative solutions and covering in-depth technical content. eWeek stays on the cutting edge of technology news and IT trends through interviews and expert analysis. Gain insight from top innovators and thought leaders in the fields of IT, business, enterprise software, startups, and more.

Property of TechnologyAdvice. © 2026 TechnologyAdvice. All Rights Reserved

Advertiser Disclosure: Some of the products that appear on this site are from companies from which TechnologyAdvice receives compensation. This compensation may impact how and where products appear on this site including, for example, the order in which they appear. TechnologyAdvice does not include all companies or all types of products available in the marketplace.