Alors que le monde de l’IA ne cesse de parler de la puissance de Gemini 3 de Google et de la virtuosité de Claude 4.5 en matière de programmation, des fuites suggèrent qu’OpenAI prépare une « frappe tactique » avec GPT-5.3.
Il ne s’agit pas d’un simple correctif mineur, mais d’une tentative de reconquérir la couronne en se concentrant sur ce que les initiés appellent la « densité cognitive » — rendre l’IA plus intelligente et plus rapide sans simplement augmenter sa taille.
Selon des fuites relayées par plusieurs sources, la nouvelle version porte le nom de code « Garlic ». Ce nom est une métaphore de la conception du modèle : de même qu’une seule gousse d’ail peut parfumer un plat entier, ce modèle est conçu pour fournir une intelligence concentrée sans le poids computationnel massif de ses prédécesseurs.
Plutôt que de se lancer dans une course aux « nombres de paramètres toujours plus élevés », OpenAI miserait sur une technique appelée Enhanced Pre-Training Efficiency (EPTE). Ce processus « élague » les données redondantes pendant l’entraînement, ce qui donne un modèle physiquement plus petit, mais qui conserve les connaissances du monde d’un système bien plus imposant. Ce changement devrait se traduire par des temps de réponse plus courts et des coûts nettement inférieurs pour les développeurs.
Nouvelles fonctionnalités : « Salute » et cartes intelligentes
Le chercheur technique Tibor Blaho a récemment repéré plusieurs changements majeurs dissimulés dans l’application web ChatGPT. La fonctionnalité la plus intrigante porte le nom de code « Salute ». D’après le code ayant fuité, elle permettra aux utilisateurs de « créer des tâches avec des téléversements de fichiers et d’en suivre la progression dans Salute ».
Les mises à jour laissent également entrevoir une meilleure expérience pour les recherches locales.
Un nouveau paramètre « is model preferred » suggère que ChatGPT sera bientôt capable de sélectionner des modèles spécifiques optimisés pour les commerces, les restaurants et les hôtels locaux dans ses widgets cartographiques. Par ailleurs, l’interface utilisateur bénéficiera d’une mise à niveau avec des « blocs de code et de formules mathématiques modifiables en ligne », permettant une édition plus interactive directement dans la conversation.
Dans les coulisses : tunnels sécurisés et contexte massif
Pour les utilisateurs avancés et les développeurs, des fuites indiquent la prise en charge d’un nouveau tunnel sécurisé pour les serveurs Model Context Protocol (MCP).
Selon la référence trouvée par Blaho, ce « tunnel sécurisé connecte votre serveur MCP interne à OpenAI via un client de tunnel hébergé par le client et utilisant HTTPS exclusivement en sortie, de sorte qu’aucune modification du pare-feu entrant n’est nécessaire ».
Au-delà de la sécurité, la « mémoire » du modèle gagne en capacité. Même s’il n’atteindra peut-être pas la fenêtre de contexte gigantesque de Gemini, GPT-5.3 devrait, selon les rumeurs, disposer d’une fenêtre de contexte de 400 000 tokens avec « Perfect Recall ». Plus impressionnante encore, la limite de sortie annoncée de 128 000 tokens pourrait permettre à l’IA d’écrire des bibliothèques logicielles entières ou des livres complets en une seule fois.
La stratégie « Code Red »
Cette offensive soudaine découlerait d’un « Code Red » interne décrété par Sam Altman en décembre 2025.
Après qu’Anthropic’s Claude 4.5 est devenu le favori des développeurs et que Gemini 3 a pris la tête des évaluations comparatives multimodales, OpenAI aurait mis en pause plusieurs projets secondaires pour se concentrer entièrement sur cette sortie. Puis, en décembre, OpenAI a lancé GPT 5.2, le modèle le plus performant de l’entreprise pour la programmation et les workflows agentiques.
Mais OpenAI cherche à décrocher le jackpot avec le modèle 5.3… et les évaluations internes relayées par CometAPI semblent indiquer que ses efforts portent leurs fruits.
GPT-5.3 atteindrait prétendument 94,2 % aux évaluations de programmation (HumanEval+), devançant à la fois Gemini 3 (89,1 %) et Claude 4.5 (91,5 %). La fiabilité est également une priorité : le modèle est entraîné avec une « humilité épistémique » afin de savoir quand dire « je ne sais pas », ce qui réduit drastiquement les hallucinations.
Quand peut-on s’attendre à le voir arriver ?
L’attente ne devrait pas être longue. Le fuiteur réputé Dan McAteer a indiqué que le modèle intégrerait un « pré-entraînement renforcé » et des « techniques de raisonnement médaillées d’or à l’IMO ». Interrogé sur le calendrier sur X, McAteer a précisé qu’il n’y avait « aucune date prévue, mais les fois précédentes où j’ai reçu ce genre d’informations, cela a pris environ une semaine, deux au maximum ».
Les experts du secteur s’attendent à un déploiement progressif à partir de la fin janvier 2026, avec d’abord une « Preview » pour les utilisateurs de ChatGPT Pro et les partenaires professionnels, puis une sortie complète de l’API en février.
À lire également : le déploiement de Gemini 3 Flash par Google montre que le positionnement axé sur la vitesse et les coûts devient un champ de bataille central dans la course à l’IA.

