Math-étique ! La « percée » mathématique de GPT-5 écope d’un F pour excès de battage

Numbered blocks with a block of man walking on top of it.

Image: Envato

Oct 20, 2025
3 minute read
eWeek Le contenu et les recommandations de produits sont indépendants de la rédaction. Nous pouvons gagner de l'argent lorsque vous cliquez sur des liens vers nos partenaires. En savoir plus

Dans une leçon très publique et très embarrassante sur la différence entre « résoudre » un problème et simplement en « trouver » la réponse, le dernier modèle d’OpenAI, GPT-5, a suscité la controverse. 

De grands chercheurs de l’entreprise ont sabré le champagne un peu trop tôt sur les réseaux sociaux, affirmant que l’IA avait résolu une série d’énigmes mathématiques notoirement difficiles. La célébration a toutefois été de courte durée, valant au géant de l’IA une sévère remontrance et une nouvelle vague de railleries dans le secteur.

Tout a commencé le 12 octobre, lorsque Sebastien Bubeck, ancien vice-président de Microsoft et désormais membre de l’équipe technique d’OpenAI, a publié sur X : « GPT-5-pro est surhumain en matière de recherche bibliographique. Il vient de “résoudre” le problème n° 339 d’Erdős… en se rendant compte qu’il avait été résolu il y a 20 ans. »

Le message semblait assez modeste, mais les choses se sont rapidement emballées. Le mathématicien Mark Sellke a enchaîné en affirmant que GPT-5 avait identifié 10 problèmes d’Erdős qui étaient « répertoriés comme ouverts » et avait réalisé des « avancées partielles significatives » sur onze autres. 

Kevin Weil, vice-président chargé des sciences chez OpenAI, a ensuite amplifié l’enthousiasme avec un message depuis supprimé : « GPT-5 vient de trouver les solutions de 10 (!) problèmes d’Erdős jusque-là non résolus, et a progressé sur 11 autres. Ils étaient tous ouverts depuis des décennies. »

On aurait dit que GPT-5 était entré dans l’histoire. Mais la communauté mathématique n’y a pas cru.

Quand « ouvert » ne signifie pas « non résolu »

Le mathématicien Thomas Bloom, qui gère le site web consacré aux problèmes d’Erdős, a rapidement douché l’enthousiasme. En réponse sur X, Bloom a écrit : « Bonjour, en tant que propriétaire et administrateur de http://erdosproblems.com, je peux dire qu’il s’agit d’une présentation complètement déformée de la réalité. GPT-5 a trouvé des références qui résolvaient ces problèmes, mais dont je n’avais personnellement pas connaissance. »

Il a précisé que lorsqu’un problème est marqué comme « ouvert » sur son site, cela signifie simplement qu’il n’a pas vu d’article le résolvant, et non que le problème n’est toujours pas résolu. Autrement dit, GPT-5 n’a pas réellement produit de nouvelles démonstrations ; il a simplement découvert des articles qui contenaient déjà les solutions.

Advertisement

Même le PDG de Google DeepMind, Demis Hassabis, est intervenu, qualifiant la situation d’« embarrassante ». Et le responsable de l’IA de MetaYann LeCun a lancé une pique plus mordante, en plaisantant : « Pris à leur propre jeu, ces GPTards. »

Au-delà du battage, la véritable histoire

Malgré le drame, l’histoire sous-jacente reste intéressante. GPT-5 a bel et bien démontré des capacités impressionnantes, non pas comme mathématicien, mais comme détective de la littérature scientifique. Il est parvenu à faire émerger des articles obscurs qui avaient échappé à un spécialiste du domaine.

Comme l’a souligné le célèbre mathématicien de l’UCLA Terence Tao, le véritable pouvoir de l’IA en mathématiques ne réside pas dans la résolution de problèmes ouverts, mais dans l’accélération du travail de fond : revue de la littérature, recherche de motifs et formulation d’hypothèses.

C’est exactement ce qu’a fait GPT-5 : il a « industrialisé » le processus de recherche. Mais pas de la manière annoncée au départ par ses utilisateurs.

Une leçon à retenir

Cet incident rappelle une fois de plus que les performances de l’IA doivent être vérifiées avec autant de soin qu’une démonstration mathématique. Pour OpenAI, l’équation est humiliante : excès de confiance + formulation maladroite = grosse erreur de calcul.

GPT-5 n’a pas ouvert de nouvelles pistes en mathématiques, mais il a lancé une discussion sur la manière dont le battage médiatique, même involontaire, peut déformer la crédibilité scientifique.

Nous vivons une époque clivante. OpenAI a suspendu l’utilisation de l’image de Martin Luther King Jr. dans Sora, après que des utilisateurs ont créé de fausses séquences montrant le leader des droits civiques d’une manière « irrespectueuse ». 

Aminu Abdullahi

Aminu Abdullahi is a B2C and B2B technology and finance writer with more than six years of experience covering enterprise IT, cybersecurity, cloud computing, artificial intelligence, fintech, business software, and emerging technologies. His work has appeared in publications including TechRepublic, eWEEK, Channel Insider, Geekflare, Enterprise Networking Planet, eSecurity Planet, CIO Insight, and Webopedia. With a technical background in computer science, he specializes in translating complex technology topics into clear, accessible content for business leaders and decision-makers.

eWeek Logo

eWeek has the latest technology news and analysis, buying guides, and product reviews for IT professionals and technology buyers. The site's focus is on innovative solutions and covering in-depth technical content. eWeek stays on the cutting edge of technology news and IT trends through interviews and expert analysis. Gain insight from top innovators and thought leaders in the fields of IT, business, enterprise software, startups, and more.

Propriété de TechnologyAdvice. © 2026 TechnologyAdvice. Tous droits réservés

Divulgation publicitaire : Certains des produits qui apparaissent sur ce site proviennent d'entreprises dont TechnologyAdvice reçoit une compensation. Cette compensation peut influencer la façon dont les produits apparaissent sur ce site, notamment l'ordre dans lequel ils apparaissent. TechnologyAdvice n'inclut pas toutes les entreprises ou tous les types de produits disponibles sur le marché.