OpenAI a mis à jour la fonctionnalité « chaîne de raisonnement » de son modèle d’IA o3-mini afin de permettre aux utilisateurs de mieux comprendre son fonctionnement. Cette annonce intervient après la sortie de DeepSeek-R1, un modèle de raisonnement concurrent qui montre lui aussi le processus de réflexion à l’origine de ses réponses.
Les modèles de raisonnement sont conçus pour décomposer leurs processus de décision étape par étape et mettent donc plus de temps à générer leurs réponses. Ces explications permettent de mieux comprendre pourquoi une réponse donnée a été formulée, et de voir pourquoi une invite a pu, ou non, aboutir au résultat souhaité. Elles permettent également aux chercheurs en IA d’identifier d’éventuels biais ou erreurs et d’améliorer ses capacités de raisonnement.

Résumé du raisonnement à l’origine d’une réponse d’o3. Image : OpenAI
Dans un post sur X, OpenAI a déclaré avoir publié « une chaîne de raisonnement mise à jour dans OpenAI o3-mini pour les utilisateurs gratuits et payants, et dans o3-mini-high pour les utilisateurs payants ». o3-mini-high est une variante payante d’o3-mini dotée de capacités de raisonnement plus poussées et de processus de réflexion plus détaillés, au prix de temps de réponse plus longs.
Pourquoi OpenAI ne dévoile-t-il ses processus de raisonnement que maintenant ?
Avant cette mise à jour, les modèles o3-mini, o1 et o1-mini d’OpenAI ne donnaient accès aux utilisateurs qu’à des résumés de la chaîne de raisonnement, et non au raisonnement complet ; l’entreprise expliquait que c’était« afin d’offrir un compromis équilibré entre rapidité et précision », même si elle a également évoqué par le passé un « avantage concurrentiel » parmi les facteurs ayant motivé cette décision. Les utilisateurs ont été menacés de bannissement lorsqu’ils ont tenté de jailbreaker o1 pour lui faire révéler l’intégralité de son processus de réflexion.
Cependant, comme le montre le R1 open source de DeepSeek, qui expose sans réserve l’intégralité du raisonnement à l’origine de ses réponses, OpenAI a décidé de ne pas vraiment lever le voile, mais de l’entrouvrir. Un représentant d’OpenAI a déclaré à eWeek que, dans cette mise à jour, « le raisonnement brut du modèle (la chaîne de raisonnement) reste masqué, car il est difficile à comprendre », mais qu’il est présenté d’une manière « facile à lire ».
Le nouveau résumé du raisonnement, plus approfondi, passera par une étape de post-traitement qui simplifiera les explications trop complexes, supprimera toute explication du raisonnement jugée « dangereuse » et le traduira dans la langue maternelle de l’utilisateur, a indiqué le représentant à eWeek. « Avec cette mise à jour, vous pourrez suivre le raisonnement du modèle, ce qui vous apportera davantage de clarté et de confiance dans ses réponses », a-t-il ajouté dans un e-mail.
Dans un récent fil Reddit, Kevin Weil, directeur produit d’OpenAI, a écrit que « montrer l’intégralité de la chaîne de raisonnement entraîne une distillation concurrentielle, mais nous savons aussi que les utilisateurs (du moins les utilisateurs avancés) le souhaitent ; nous trouverons donc le bon équilibre ». C’est le résultat de cet équilibre.
À lire aussi : Sam Altman affirme qu’OpenAI s’est retrouvée « du mauvais côté de l’histoire » en matière d’open source

