OpenAI a présenté GPT-5.3-Codex le 5 février, un nouveau modèle d’IA conçu pour étendre considérablement les capacités de son agent Codex sur ordinateur.
L’entreprise affirme que ce modèle est son système agentique de codage le plus performant à ce jour. Il combine des compétences avancées en programmation avec de meilleures capacités de raisonnement et des connaissances professionnelles plus solides. Selon OpenAI, GPT-5.3-Codex est 25 % plus rapide que son prédécesseur. Il est également conçu pour prendre en charge de longues tâches complexes pouvant faire intervenir de la recherche, l’utilisation d’outils et une exécution en plusieurs étapes.
« Avec GPT‑5.3-Codex, Codex passe d’un agent capable d’écrire et de relire du code à un agent capable de faire presque tout ce que les développeurs et les professionnels peuvent faire sur un ordinateur », selon l’entreprise.
L’une des affirmations les plus frappantes du communiqué d’OpenAI concerne la manière dont le modèle a été développé. L’entreprise affirme que GPT-5.3-Codex est le premier modèle d’OpenAI à avoir joué un rôle déterminant dans sa propre création.
« L’équipe Codex a utilisé les premières versions pour déboguer son propre entraînement, gérer son propre déploiement et diagnostiquer les résultats des tests et des évaluations », a écrit OpenAI, ajoutant que l’équipe avait été « époustouflée » par l’accélération du développement.
De solides résultats aux benchmarks
GPT-5.3-Codex a obtenu les meilleurs scores sur des benchmarks du secteur, notamment SWE-Bench Pro et Terminal-Bench 2.0.
Le modèle a obtenu 77,3 % à Terminal-Bench 2.0 et 64,7 % à OSWorld-Verified, des benchmarks qui évaluent les agents dans des tâches exécutées sur de véritables environnements informatiques.
OpenAI a également mis en avant la meilleure compréhension par le modèle des intentions de l’utilisateur. Lorsqu’on lui soumet des demandes simples ou vagues pour créer un site web, le modèle privilégie désormais par défaut des designs plus fonctionnels dotés de fonctionnalités pertinentes, plutôt que d’exiger des spécifications détaillées.
Cette annonce est intervenue quelques minutes seulement après que le rival d’OpenAI, Anthropic, a présenté son propre modèle puissant, Claude Opus 4.6, soulignant la vive concurrence dans le secteur de l’IA.
Des capacités étendues
Les capacités du modèle vont bien au-delà du codage. Il peut gérer le débogage, le déploiement, la supervision, la rédaction de documents d’exigences produit, la révision de textes, la recherche utilisateur, la réalisation de tests, l’analyse de métriques ainsi que la création de présentations et de feuilles de calcul.
OpenAI a démontré de solides performances sur GDPval, une évaluation lancée par l’entreprise en 2025 qui mesure les performances de l’IA dans des tâches de travail intellectuel couvrant 44 professions, notamment la création de présentations et de feuilles de calcul.
OpenAI affirme que GPT-5.3-Codex est le premier modèle qu’elle classe comme présentant une « haute capacité » pour les tâches de cybersécurité dans le cadre de son Preparedness Framework.
Le modèle a été entraîné directement à identifier les vulnérabilités logicielles, et OpenAI affirme déployer ses mesures de cybersécurité les plus complètes à ce jour. Celles-ci comprennent une supervision automatisée, des contrôles d’accès de confiance et des pipelines d’application des règles liés aux renseignements sur les menaces.
Parallèlement à cette annonce, OpenAI a lancé un programme pilote Trusted Access for Cyber et engagé 10 millions de dollars US en crédits API pour soutenir la recherche en cybersécurité, en particulier les projets open source et les infrastructures critiques.
Disponible dès maintenant, mais l’avenir s’appelle « Frontier »
GPT-5.3-Codex est désormais disponible pour les utilisateurs payants de ChatGPT dans l’application Codex, l’interface en ligne de commande, les extensions IDE et sur le web. L’accès à l’API sera bientôt disponible.
Ce lancement coïncide également avec la nouvelle plateforme « Frontier » d’OpenAI, destinée aux entreprises et conçue pour les aider à créer et à gérer des équipes d’agents IA. Parmi les premiers utilisateurs figurent de grands noms comme HP, Intuit et Uber.
Pour découvrir concrètement comment les principaux assistants d’IA se comportent dans des tâches quotidiennes comme les e-mails, la planification et les demandes créatives, consultez cette comparaison de Gemini 3 et ChatGPT 5.2 publiée par eWeek.

