DeepSeek élargit l’accès à son dernier modèle d’IA, misant sur de meilleures performances pour les tâches autonomes et des tarifs bas afin de séduire davantage de développeurs.
La start-up chinoise spécialisée dans l’IA DeepSeek a lancé la bêta publique de son interface de programmation d’applications (API) DeepSeek V4-Flash, offrant aux développeurs un accès élargi au dernier modèle léger phare de l’entreprise, avant la sortie complète de V4-Pro.
Cette bêta publique fait suite aux versions préliminaires lancées en avril. DeepSeek a déclaré que la version officielle de V4-Pro « sortira bientôt ».
Selon l’entreprise, la dernière mise à jour de V4-Flash vise à améliorer les capacités des agents IA — c’est-à-dire la capacité des modèles à accomplir des tâches complexes en plusieurs étapes en planifiant leurs actions et en utilisant des outils externes. DeepSeek affirme que le modèle offre « des capacités d’agent nettement améliorées, avec des résultats aux benchmarks largement supérieurs à ceux de V4-Pro-Preview ».
L’entreprise a également indiqué que le modèle prend désormais nativement en charge le format de l’API Responses et qu’il est compatible avec les workflows de développement reposant sur Codex, ce qui facilite son intégration par les développeurs dans les applications d’IA existantes.
DeepSeek a précisé que la version officielle de V4-Flash conserve la même architecture et le même nombre de paramètres que la version préliminaire, les améliorations provenant entièrement de la phase de post-entraînement plutôt que de modifications du modèle sous-jacent.
L’entreprise a fait état de résultats plus solides sur plusieurs benchmarks axés sur le code et les agents, notamment Terminal Bench 2,1, Cybergym, DeepSWE, NL2Repo, Toolathlon Verified et ses évaluations internes DSBench. Lors de plusieurs tests, le V4-Flash mis à jour a surpassé la version préliminaire antérieure de V4-Pro, alors même qu’il s’agit du modèle le plus petit.
Pour l’instant, la mise à niveau se limite à l’API. L’interface web, l’application mobile et l’API V4-Pro de DeepSeek restent inchangées.
La stratégie tarifaire attise la concurrence dans l’IA
Le lancement intervient alors que la concurrence sur les tarifs de l’IA continue de s’intensifier.
DeepSeek a déclaré prévoir une tarification aux heures de pointe après la sortie des modèles V4 officiels, avec un tarif d’API doublé pendant les périodes de plus forte demande. Même avec ces prix plus élevés, les comparaisons du secteur indiquent que les modèles de l’entreprise resteraient nettement moins chers que les offres concurrentes des grands fournisseurs américains d’IA.
L’entreprise a déjà contribué à remodeler le marché chinois de l’IA grâce à une politique tarifaire agressive. Plus tôt cette année, elle a réduit définitivement de 75 % les prix des modèles V4, incitant notamment ByteDance et Tencent à baisser leurs propres tarifs.
Ce que cela signifie pour les développeurs et les entreprises
Cette dernière version illustre une évolution croissante du secteur de l’IA. Plutôt que de s’appuyer uniquement sur des modèles toujours plus grands, les entreprises cherchent de plus en plus à améliorer les performances grâce à un meilleur entraînement tout en gardant les coûts sous contrôle.
Pour les développeurs, cela pourrait se traduire par des agents IA plus rapides et moins coûteux pour le codage, l’ingénierie logicielle, l’automatisation et d’autres workflows d’entreprise, sans nécessiter les modèles les plus imposants disponibles.
Les entreprises qui évaluent les plateformes d’IA pourraient également profiter d’une compatibilité élargie. La prise en charge du format de l’API Responses et des outils fondés sur Codex réduit les obstacles à la migration pour les équipes qui s’appuient déjà sur des frameworks établis de développement de l’IA.
L’inconvénient est que les nouvelles fonctionnalités ne sont actuellement accessibles que via l’API, ce qui signifie que les utilisateurs des produits web et mobiles de DeepSeek devront attendre leur déploiement.
À lire aussi : La levée de boucliers contre les détecteurs d’IA montre comment l’outil de filtrage de Substack, alimenté par Pangram, met à l’épreuve la confiance des auteurs alors que les inquiétudes liées aux faux positifs créent des risques pour la réputation.

