OpenAI a annoncé lundi la sortie de GPT-4.1, le nouveau modèle appelé à succéder à sa série de modèles de langage IA GPT-4o. Selon OpenAI, GPT-4.1 excelle dans le suivi des instructions, le codage et le traitement des contextes longs.
Le grand modèle de langage GPT-4.1 apporte des fonctionnalités améliorées et des capacités de codage renforcées à la gamme de modèles GPT-4o de nouvelle génération. La série GPT-4o comprend les modèles GPT-4.1 mini et GPT-4.1 nano. OpenAI a confirmé que la version mini bénéficierait de la prise en charge du réglage fin supervisé. En outre, OpenAI a indiqué que l’entreprise prévoyait de retirer le modèle GPT-4.5 Preview de l’API.
GPT-4.1 ne sera pas disponible dans l’interface grand public de ChatGPT ; il est accessible exclusivement via l’API destinée aux développeurs.
Les fonctionnalités phares de GPT-4.1
Le modèle d’IA GPT-4.1 est entraîné pour accompagner les développeurs grâce à ses capacités de codage et de suivi des instructions, en améliorant les workflows agentiques et en accélérant la productivité.
GPT-4.1 conserve les mêmes capacités d’API que la famille de modèles GPT-4o, notamment les sorties structurées et l’appel d’outils. Il présente également des améliorations par rapport aux modèles précédents, notamment :
- Fenêtre de contexte plus longue : GPT-4.1 prend en charge jusqu’à un million de tokens, soit environ quatre fois plus que GPT-4o, ce qui lui permet d’ingérer et de comprendre davantage de contexte au cours d’une même interaction.
- Codage amélioré : Le modèle peut traiter des problèmes techniques et de codage complexes avec davantage de constance et de précision.
- Meilleur suivi des instructions : GPT-4.1 est optimisé pour suivre des instructions détaillées, car il est plus intuitif et collaboratif.
- Base de connaissances actualisée : GPT-4.1 dispose d’une date de coupure des connaissances plus récente (jusqu’en juin 2024), offrant une période de référence mieux adaptée à l’actualité.
- Scores plus élevés aux benchmarks : GPT-4.1 a obtenu un score de 54,6 % au benchmark de codage utilisé dans le secteur, le SWE-bench Verified, améliorant nettement le score de 38,0 % obtenu par GPT-4.5.
- Meilleure compréhension des vidéos : Lors de l’utilisation de Video-MME pour mesurer la capacité du modèle à comprendre le contenu vidéo, GPT-4.1 a atteint une impressionnante précision de 72 % dans la catégorie des vidéos « longues, sans sous-titres ».
À 2 dollars US par million de tokens en entrée et 8 dollars US par million de tokens en sortie, GPT-4.1 offre des performances concurrentielles raisonnables au regard de son prix, selon les tests internes d’OpenAI. Ces évaluations de GPT-4.1 couvraient un éventail de benchmarks, détaillés dans l’annonce d’OpenAI.
Les inconvénients de GPT-4.1
OpenAI a reconnu certains inconvénients de GPT-4.1, notamment :
- Sa tendance à exiger des prompts plus précis que GPT-4o.
- Le modèle devient moins fiable à mesure que le nombre de tokens d’entrée à traiter augmente. Lors d’un test OpenAI-MRCR, la précision du modèle est passée d’environ 84 % avec 8 000 tokens à 50 % avec 1 million de tokens.
Les concurrents d’OpenAI
OpenAI fait partie des nombreuses entreprises technologiques qui entraînent des modèles d’IA pour le codage afin d’aider à accomplir des tâches complexes d’ingénierie logicielle. Les concurrents d’OpenAI dans le secteur travaillent eux aussi à développer leurs propres modèles de programmation sophistiqués, notamment Claude 3.7 Sonnet d’Anthropic, Gemini 2.5 Pro de Google et V3 amélioré de DeepSeek.

