L’IA peut-elle réussir l’ultime test d’intelligence de l’humanité ?

A robot teacher and a student in a classroom.

Image: stockasso/Envato Elements

Jan 24, 2025
3 minute read
eWeek Le contenu et les recommandations de produits sont indépendants de la rédaction. Nous pouvons gagner de l'argent lorsque vous cliquez sur des liens vers nos partenaires. En savoir plus

Un benchmark d’IA révolutionnaire baptisé « L’ultime examen de l’humanité » fait des vagues dans la communauté de l’IA. Mis au point par le Center for AI Safety (CAIS) en partenariat avec Scale AI, il vise à devenir le test ultime pour déterminer si l’IA peut atteindre un niveau de raisonnement, de créativité et de résolution de problèmes comparable à celui des humains. Ce sont ces facultés qui distinguent l’intelligence véritable de la simple imitation.

L’ultime examen de l’humanité est conçu pour repousser les limites de ce que l’IA peut accomplir. Il s’agit d’un benchmark qui demande aux systèmes d’IA de démontrer des capacités allant bien au-delà des tâches traditionnelles, établissant ainsi une nouvelle référence pour l’évaluation de l’IA.

Un benchmark d’IA pas comme les autres

L’ultime examen de l’humanité ne vise pas à mesurer la puissance de calcul brute ni la précision dans des tâches comme le résumé d’articles ou l’identification d’images. Il évalue plutôt l’intelligence générale et le raisonnement éthique. Le benchmark met l’IA au défi de répondre à des questions de mathématiques, de sciences et de logique, tout en abordant des dilemmes moraux et les implications des technologies émergentes.

« Nous voulions des problèmes capables de tester les capacités des modèles à la frontière des connaissances et du raisonnement humains », a expliqué CAIS co-founder and executive director Dan Hendrycks.

L’une des particularités de ce benchmark est l’intégration de défis « en monde ouvert », dans lesquels les problèmes n’ont pas une seule réponse correcte. L’IA peut par exemple analyser des situations hypothétiques qui mettent en balance des considérations éthiques et anticiper leurs conséquences à long terme. Ce test ambitieux pousse l’IA à faire preuve de compréhension contextuelle et de discernement.

L’IA devient-elle trop intelligente ?

Les détracteurs se demandent si L’ultime examen de l’humanité n’accorde pas trop d’importance aux caractéristiques humaines, ce qui alimente les débats sur sa pertinence et les craintes de voir un jour l’IA dépasser l’intelligence humaine. Ses partisans estiment toutefois que des benchmarks comme celui-ci sont essentiels pour explorer les véritables capacités de l’IA et en révéler les limites. En repoussant les frontières, ce test offre un aperçu crucial de l’avenir de l’IA, un avenir fascinant et, pour certains, quelque peu inquiétant. De quoi laisser ouverte la question : est-ce la clé pour comprendre l’IA, ou sommes-nous en train de nous aventurer sur un terrain auquel nous ne sommes pas prêts à faire face ?

Advertisement

Et maintenant ?

Les premiers essais ont déjà commencé, avec la participation de grands acteurs comme OpenAI, Anthropic et Google Deepmind. Pour l’instant, les modèles GPT-4 et GPT-o1 d’OpenAI sont en tête, mais aucun modèle d’IA n’a encore franchi le seuil des 50 %… pour l’instant. Hendrycks soupçonne que les scores des modèles d’IA pourraient dépasser ce seuil d’ici la fin de l’année. Reste à savoir si L’ultime examen de l’humanité se révélera un défi insurmontable ou le début d’une nouvelle ère pour l’intelligence artificielle générale.

Lisez nos analyses de Grok, ChatGPT, et de Gemini et jugez vous-même leur intelligence.

Brittany Brooks

Brittany Brooks is a content writer with seven years of experience and has a passion for AI-driven innovation. For the past three years, she’s mastered AI-enabled tools and the art of prompt engineering to generate precise and impactful results. Alongside her writing, Brittany has developed strong skills in data analysis, leveraging AI to extract actionable insights and drive strategic decision-making. Obsessed with the intersection of AI and analytics, Brittany explores new ways to leverage AI to solve complex problems. As a self-proclaimed and proud tech geek, she embraces emerging technology and its future potential. When she’s not writing or analyzing data, you can find her in one of her many VR leagues, fully immersed in the next evolution of digital experiences.

eWeek Logo

eWeek has the latest technology news and analysis, buying guides, and product reviews for IT professionals and technology buyers. The site's focus is on innovative solutions and covering in-depth technical content. eWeek stays on the cutting edge of technology news and IT trends through interviews and expert analysis. Gain insight from top innovators and thought leaders in the fields of IT, business, enterprise software, startups, and more.

Propriété de TechnologyAdvice. © 2026 TechnologyAdvice. Tous droits réservés

Divulgation publicitaire : Certains des produits qui apparaissent sur ce site proviennent d'entreprises dont TechnologyAdvice reçoit une compensation. Cette compensation peut influencer la façon dont les produits apparaissent sur ce site, notamment l'ordre dans lequel ils apparaissent. TechnologyAdvice n'inclut pas toutes les entreprises ou tous les types de produits disponibles sur le marché.