La start-up chinoise spécialisée dans l’IA DeepSeek a présenté DeepSeek V3.1, une mise à jour majeure de son modèle V3, que l’entreprise présente comme son premier pas dans « l’ère des agents ».
Dans une publication sur Weixin annonçant ce lancement, DeepSeek a déclaré que la mise à jour introduisait une « architecture de raisonnement hybride : un modèle prenant en charge à la fois le mode réflexion et le mode sans réflexion ». Les utilisateurs peuvent activer cette fonctionnalité grâce à un nouveau bouton Deep Thinking disponible dans l’application et sur la plateforme web.
Le modèle V3.1 est conçu pour traiter les tâches plus efficacement que son prédécesseur. DeepSeek a précisé que, par rapport au précédent modèle R1-0528, « DeepSeek-V3.1-Think peut fournir des réponses en moins de temps ».
Au-delà de la vitesse, la mise à jour améliore les performances de type agent, permettant au modèle d’utiliser des outils et d’effectuer des tâches de programmation plus efficacement. Dans des benchmarks de programmation tels que SWE-bench Verified, le modèle a surpassé le R1-0528 de DeepSeek avec un score de 66,0 %, contre 44,6 % pour le R1.
Optimisation pour les puces nationales
L’un des changements techniques les plus importants ? V3.1 est optimisé pour fonctionner avec le futur écosystème chinois des semi-conducteurs.
Le modèle prend désormais en charge le format de précision UE8M0 FP8, ce qui lui permet de fonctionner plus rapidement et avec moins de mémoire. Cette priorité donnée à la compatibilité avec les composants nationaux intervient alors que Pékin cherche à réduire sa dépendance aux technologies américaines dans un contexte de restrictions persistantes à l’exportation.
Open source et extension de l’API
DeepSeek a annoncé que le modèle de base de V3.1, réentraîné sur 840 milliards de tokens, était désormais disponible sur Hugging Face et ModelScope, les versions de base et post-entraînée étant toutes deux accessibles aux développeurs.
L’API a également été mise à niveau, avec la prise en charge de fenêtres de contexte plus longues, de 128 k, ainsi que de nouvelles fonctionnalités d’appel de fonctions. Les développeurs peuvent désormais intégrer DeepSeek plus facilement, notamment avec les formats d’API d’Anthropic, ce qui élargit sa compatibilité avec les frameworks existants.
L’entreprise a averti que V3.1 introduisait des changements importants au niveau de son tokenizer et de ses modèles de conversation par rapport aux versions précédentes, et a encouragé les développeurs à consulter attentivement la documentation avant de le déployer.
Changements tarifaires en septembre
Parallèlement au lancement, DeepSeek a présenté une nouvelle tarification pour ses services d’API. Cette nouvelle structure entrera en vigueur le 6 septembre 2025.
DeepSeek se distingue parmi les concurrents de l’IA
DeepSeek a attiré l’attention du monde entier en janvierlorsque son modèle R1 a ébranlé le secteur grâce à ses performances élevées pour un coût inférieur. Les progrès rapides de l’entreprise lui ont permis de rester en concurrence avec des acteurs occidentaux comme OpenAI, même sans accès aux semi-conducteurs les plus avancés.
DeepSeek V3.1 témoigne du passage de la start-up vers un avenir de l’IA dominé par les agents.
Dans la course à la domination de l’IA, découvrez comment les modèles de DeepSeek se comparent à ceux de concurrents tels qu’OpenAI et Alibaba.

