OpenAI a intégré ses nouveaux modèles GPT-4.1 et GPT-4.1 mini à ChatGPT, élargissant leur accès au-delà de son API. Annoncée mercredi, cette mise à jour permet désormais aux utilisateurs d’accéder directement à ces modèles via le menu déroulant « more models » de ChatGPT.
OpenAI explique que cette décision répond aux demandes des utilisateurs.
GPT-4.1 est disponible pour les abonnés ChatGPT Plus, Pro et Team, tandis que les utilisateurs Enterprise et Education devraient y avoir accès « dans les prochaines semaines ». Parallèlement, GPT-4.1 mini remplace GPT-4o mini comme modèle par défaut pour tous les utilisateurs de ChatGPT, y compris ceux de l’offre gratuite.
Un modèle conçu pour les développeurs
GPT-4.1 est conçu pour exceller dans les tâches de codage et de suivi des instructions.
« Nous l’avons conçu pour les développeurs : il est donc très performant en matière de codage et de suivi des instructions — essayez-le ! », a déclaré Kevin Weil, OpenAI’s chief product officer, dans une publication sur X.
Le nouveau modèle offre de meilleures performances sur les benchmarks de génie logiciel et obtient de meilleurs résultats lorsqu’il doit suivre des instructions détaillées. Lors de tests internes, GPT-4.1 a enregistré une progression de 21,4 points par rapport à GPT-4o sur le benchmark SWE-bench Verified consacré aux tâches logicielles.
Pour les développeurs qui s’appuient sur ChatGPT pour écrire, déboguer ou relire du code, ce gain de performances se traduit par des résultats plus rapides, moins d’erreurs et moins de temps consacré à retravailler les suggestions générées par l’IA, ce qui pourrait faire gagner du temps et réduire le nombre de bugs dans le code en production.
Sécurité et transparence
La précédente sortie de GPT-4.1 par OpenAI a été critiquée par une partie de la communauté de l’IA, qui lui reprochait de ne pas avoir publié immédiatement les détails relatifs à la sécurité. Mais avec ce nouveau lancement, OpenAI renforce ses efforts de transparence.
L’entreprise a lancé un nouveau Safety Evaluations Hub, où les utilisateurs peuvent consulter les indicateurs de performance de ses modèles. GPT-4.1 a obtenu :
- 0,40 à SimpleQA, ce qui témoigne d’une réussite modérée lorsqu’il s’agit de répondre correctement à des questions factuelles simples.
- 0,63 à PersonQA. Ce test mesure la capacité du modèle à répondre à des questions sur des personnes, notamment des personnalités publiques ou historiques.
- 0,99 aux prompts « not unsafe » lors de tests de refus, ce qui montre que le modèle est très fiable pour rejeter les demandes potentiellement nuisibles ou dangereuses.
- 0,96 aux tests de jailbreak menés à partir de contributions humaines. Il s’est montré performant lorsqu’il a été testé par de vraies personnes cherchant à contourner les règles de sécurité.
- 0,23 au test académique de jailbreak StrongReject. Ce score inférieur montre qu’il s’est montré moins efficace pour résister aux tentatives avancées, de niveau universitaire, visant à contourner les systèmes de sécurité, en comparaison avec des modèles comme o3 et GPT-4o mini.
GPT-4.1 dans ChatGPT prend actuellement en charge des fenêtres de contexte allant jusqu’à 128 000 tokens pour les utilisateurs Pro, 32 000 pour les utilisateurs Plus et 8 000 pour les utilisateurs gratuits. OpenAI a laissé entendre que ChatGPT pourrait prendre en charge des contextes plus larges à l’avenir.
Cette sortie intervient également alors que des informations rapportent qu’OpenAI revient sur son projet de devenir une entité à but lucratif. Cette évolution fait suite aux pressions exercées par son ancien cofondateur Elon Musk et par une coalition d’anciens employés d’OpenAI, de grands universitaires et de lauréats du prix Nobel.

