Un modèle d’OpenAI fait croire aux gens qu’il est humain dans 73 % des échanges et réussit le test de Turing

Screenshot of an OpenAI demo video of AI model GPT 4.5 with researchers.

Screenshot of an OpenAI demo video of AI model GPT 4.5 with researchers. Image: OpenAI/YouTube

Written By
Esther Shein
Esther Shein
Apr 5, 2025
3 minute read
eWeek content and product recommendations are editorially independent. We may make money when you click on links to our partners. Learn More

Le modèle GPT-4.5 d’OpenAI a définitivement réussi le test de Turing, après avoir été identifié comme humain dans 73 % des cas où il lui était demandé d’adopter une personnalité humaine. Le test de Turing, nommé ainsi en hommage à l’informaticien britannique Alan Turing en 1950, mesure la capacité d’une machine à manifester une intelligence comparable à celle de l’humain au cours d’une conversation avec un évaluateur humain.

Le dernier test mené par des chercheurs de l’université de Californie à San Diego a révélé que GPT-4.5 faisait croire aux humains que le modèle d’IA était une personne lors d’échanges textuels — plus souvent que de véritables humains ne parvenaient à convaincre les autres qu’ils étaient une personne.

Cette réussite, « Les grands modèles de langage réussissent le test de Turing », est en attente d’évaluation par les pairs.

Suis-je humain ?

L’expérience reposait sur un test à trois mené sur une plateforme en ligne. Près de 300 étudiants ont été répartis aléatoirement entre le rôle de juge et celui de l’un des deux « témoins », l’autre témoin étant un chatbot. Les deux témoins devaient convaincre le juge humain qu’ils étaient humains à partir des messages texte qu’ils envoyaient tous les deux. Le juge devait ensuite déterminer qui était qui.

Trois autres programmes d’IA ont également été testés :

  • LLaMa 3.1 405b de Meta, jugé humain dans 56 % des cas.
  • ELIZA, un chatbot très ancien datant des années 1960, jugé humain dans 23 % des cas.
  • GPT-4o, le précédent modèle d’OpenAI, GPT-4o, jugé humain dans 21 % des cas.

« Les participants ne faisaient pas mieux que le hasard pour distinguer les humains de GPT-4.5 et de LLaMa (avec l’invite de persona) », a conclu Cameron Jones, chercheur au Language and Cognition Lab de l’UC San Diego, dans une publication sur X consacrée à ces travaux. « Et 4.5 a même été jugé humain nettement plus souvent que les véritables humains ! »

Que disent les autres experts de l’IA à propos de cette étude ?

Certains chercheurs ne pensent pas que cela signifie que le modèle a atteint ou dépassé les capacités humaines et qu’il est réellement capable de penser, un concept connu sous le nom d’intelligence artificielle générale, ou IAG.

Dans la revue Science, la spécialiste de l’IA Melanie Mitchell, professeure au Santa Fe Institute de Santa Fe, au Nouveau-Mexique, a écrit que le test de Turing mesure moins l’intelligence véritable qu’il ne reflète les présupposés humains. Même si une IA obtient de bons résultats à un test, « la capacité à s’exprimer couramment en langage naturel, tout comme le fait de jouer aux échecs, ne constitue pas une preuve concluante d’une intelligence générale », a écrit Mitchell.

Advertisement

Elle a également cité un communiqué de presse publié en 2024 par l’université Stanford, qui présentait les travaux d’une équipe de Stanford sur le précédent modèle GPT 4 comme marquant « l’une des premières fois où une source d’intelligence artificielle a réussi un test de Turing rigoureux ». L’équipe avait « pour ainsi dire constitué le test de Turing en comparant les statistiques du comportement de GPT-4 lors d’enquêtes psychologiques et de jeux interactifs à celles des humains », a souligné Mitchell.

Mais la formulation de l’équipe, a-t-elle ajouté, « pourrait ne pas être reconnaissable par Turing ».

Découvrez ces photos sur la vie d’Alan Turing sur notre site partenaire TechRepublic.

Esther Shein

Esther Shein is a freelance writer and editor who specializes in writing about AI, cloud, cybersecurity, data, software, and IT leadership. In addition to TechRepublic and eWeek, her work has appeared in CIO.com, CSOOnline, ZDNet, TechTarget, Communications of the ACM, Consumer Goods Technology, Computerworld, The Boston Globe, and Inc. She has also written thought leadership whitepapers, ebooks, case studies, and marketing materials.

eWeek Logo

eWeek has the latest technology news and analysis, buying guides, and product reviews for IT professionals and technology buyers. The site's focus is on innovative solutions and covering in-depth technical content. eWeek stays on the cutting edge of technology news and IT trends through interviews and expert analysis. Gain insight from top innovators and thought leaders in the fields of IT, business, enterprise software, startups, and more.

Property of TechnologyAdvice. © 2026 TechnologyAdvice. All Rights Reserved

Advertiser Disclosure: Some of the products that appear on this site are from companies from which TechnologyAdvice receives compensation. This compensation may impact how and where products appear on this site including, for example, the order in which they appear. TechnologyAdvice does not include all companies or all types of products available in the marketplace.