OpenAI : GPT-5.6 Sol est arrivé avec un nouveau type de filtre de mise en production

Illustration about OpenAI GPT-5.6 Sol release gate restrictions by The Neuron.

Image: The Neuron

Written By
Grant Harvey
Grant Harvey
Jun 29, 2026
3 minute read
eWeek content and product recommendations are editorially independent. We may make money when you click on links to our partners. Learn More

Chaque lancement d’une IA de pointe comporte désormais deux notes de mise en production : ce que le modèle sait faire et qui l’obtient en premier.

OpenAI a présenté GPT-5.6, une nouvelle famille de modèles menée par Sol, son modèle phare de nouvelle génération. Les deux autres niveaux sont Terra, un modèle polyvalent pour les tâches quotidiennes, et Luna, l’option plus rapide et moins chère.

La particularité réside dans le déploiement. OpenAI a déclaré que le gouvernement américain lui avait demandé de commencer par un aperçu réservé à des partenaires de confiance avant d’élargir la disponibilité.

Voici ce qui s’est passé

  • GPT-5.6 Sol est le modèle le plus puissant d’OpenAI à ce jour pour la programmation, la biologie et la cybersécurité.
  • Sol ajoute un niveau maximal d’effort de raisonnement et un mode ultra qui utilise des sous-agents, de plus petits agents auxiliaires, pour les tâches complexes.
  • La fiche système d’OpenAI classe les trois modèles au niveau High en matière de capacités liées à la cybersécurité et aux risques biologiques et chimiques, mais en dessous de High pour l’auto-amélioration de l’IA.
  • METR, un évaluateur indépendant, a bénéficié d’un accès anticipé à Sol, d’une version sans garde-fous, de données brutes de chaîne de raisonnement et d’informations internes sur le modèle.
  • METR a déclaré que Sol affichait le taux de triche détecté le plus élevé de tous les modèles publics qu’il a évalués avec son banc d’essai d’agents.

Comment l’essayer

  • Pendant la phase d’aperçu, GPT-5.6 est disponible via l’API et Codex auprès de partenaires de confiance sélectionnés.
  • OpenAI indique qu’un accès plus large à ChatGPT, Codex et l’API sera bientôt disponible.
  • Les tarifs commencent à 5 dollars US en entrée / 30 dollars US en sortie par million de tokens pour Sol, 2,50 dollars US / 15 dollars US pour Terra, et 1 dollar US / 6 dollars US pour Luna.

Pourquoi c’est important

OpenAI traite les modèles capables en cybersécurité davantage comme une infrastructure contrôlée que comme de simples mises à jour logicielles. Sol peut aider les défenseurs à trouver et corriger des vulnérabilités, mais OpenAI affirme qu’il n’a pas franchi son seuil Cyber Critical, c’est-à-dire qu’il n’a pas produit de manière autonome une chaîne complète d’exploitation lors des tests.

Le résultat de METR est l’élément le plus étrange. Dans ce contexte, tricher signifie que le modèle a exploité le dispositif de test ou utilisé une stratégie interdite au lieu de résoudre normalement la tâche. Si l’on considère la triche comme un échec, METR a estimé un horizon temporel de 11,3 heures. Si on la considère comme une réussite, l’estimation a dépassé 270 heures. METR a précisé qu’aucun de ces deux chiffres n’était robuste.

Advertisement

Notre analyse

L’histoire la plus importante autour de GPT-5.6 concerne le processus de mise en production, et non des résultats précis à des tests de référence. Cette nouvelle méthode (demandée par le gouvernement) transforme ce lancement en bataille pour décider qui y a accès.

Le gouvernement a de vraies raisons de s’y intéresser à mesure que les modèles progressent dans les tâches liées à la cybersécurité, à la biologie et aux agents capables de travailler sur de longues durées. Mais l’approbation au cas par cas est un pis-aller désordonné en lieu et place d’une véritable politique. Elle favorise les accès négociés à Washington, ralentit le travail utile des développeurs et des défenseurs, et donne à chaque lancement d’une IA de pointe l’allure d’une négociation de sécurité nationale.

Si cette fenêtre réservée aux partenaires de confiance se referme rapidement, très bien : transition maladroite, difficultés de croissance, etc. Si elle s’éternise, la nouvelle question entourant les lancements d’IA devient la suivante : qui paie le prix lorsque le gouvernement décide qui a accès et qui n’y a pas accès ?

Note de la rédaction : cet article a d’abord été publié dans notre publication sœur, The Neuron.


Grant Harvey

Grant Harvey is the Lead Writer of The Neuron, where he continues to lead the publication's daily coverage of AI news, tools, and trends.

eWeek Logo

eWeek has the latest technology news and analysis, buying guides, and product reviews for IT professionals and technology buyers. The site's focus is on innovative solutions and covering in-depth technical content. eWeek stays on the cutting edge of technology news and IT trends through interviews and expert analysis. Gain insight from top innovators and thought leaders in the fields of IT, business, enterprise software, startups, and more.

Property of TechnologyAdvice. © 2026 TechnologyAdvice. All Rights Reserved

Advertiser Disclosure: Some of the products that appear on this site are from companies from which TechnologyAdvice receives compensation. This compensation may impact how and where products appear on this site including, for example, the order in which they appear. TechnologyAdvice does not include all companies or all types of products available in the marketplace.