Amazon accélère fortement le déploiement de son IA en ajoutant 18 nouveaux modèles à poids ouverts à Amazon Bedrock, dans l’une de ses plus importantes extensions à ce jour.
Cette mise à jour apporte de nouvelles capacités multimodales à la plateforme et accueille en premier les modèles les plus récents de Mistral.
Dans une publication du blog AWS News Blog, le blogueur en chef Channy Yun a déclaré que cette extension portait la gamme de Bedrock à près de 100 modèles, avec de nouveaux venus de Mistral, Google, Nvidia, OpenAI, MiniMax, Moonshot et Qwen.
AWS présente cette mise à jour comme une amélioration d’envergure destinée à offrir davantage de choix aux clients, sans toucher à leur infrastructure existante.
Un large éventail de fournisseurs d’IA rejoint la dernière extension
Les nouveaux modèles ajoutés proposent un ensemble varié de modèles issus de grands développeurs d’IA. Parmi les ajouts les plus remarquables :
- Google Gemma 3: Des modèles multimodaux légers pour les usages locaux de texte et d’image sur les ordinateurs portables et les stations de travail.
- Nvidia Nemotron Nano 2 : Des modèles axés sur l’efficacité, conçus pour le raisonnement, le codage et la compréhension vidéo.
- OpenAI gpt-oss-safeguard : De nouveaux classificateurs de sécurité pour l’application des règles et la modération de contenus à grande échelle.
- MiniMax M2 : Des modèles d’automatisation du codage capables de modifier plusieurs fichiers et d’enchaîner de longues séquences d’appels d’outils.
- Moonshot Kimi K2 Thinking : Un modèle de raisonnement approfondi pour les processus de travail de recherche complexes et en plusieurs étapes.
- Qwen3-Next et Qwen3-VL : Des modèles à long contexte et de vision prenant en charge l’extraction de documents, la génération de code et l’analyse vidéo.
L’ensemble couvre les usages liés au langage, à la vision, à l’audio et à la sécurité, élargissant ainsi les possibilités de Bedrock, qui se dirige vers un catalogue de modèles à trois chiffres.
Les modèles de Mistral sous les projecteurs
La nouvelle gamme de Mistral constitue la pièce maîtresse de la mise à jour.
Mistral Large 3 s’impose comme un modèle multimodal polyvalent à long contexte, conçu pour les tâches d’entreprise complexes, des processus faisant largement appel aux documents et de l’analyse multilingue au codage avancé et aux agents utilisant des outils. Il est optimisé pour fournir des résultats fiables sur des invites longues et pour effectuer des raisonnements combinant texte et vision.
Parallèlement, AWS déploie la gamme complète Ministral 3 — 3B, 8B et 14B — dont tous les modèles sont conçus pour fonctionner efficacement sur un seul GPU. Le plus petit modèle cible les tâches légères de vision et de langage sur les appareils en périphérie, tandis que la variante 8B équilibre encombrement et performances pour les interfaces conversationnelles et les systèmes intégrés. La version 14B complète l’ensemble avec des capacités de pointe en texte et en vision pour les déploiements privés sur site, lorsque les ressources matérielles sont limitées.
AWS affirme que Bedrock est la première plateforme à héberger ces modèles, offrant ainsi à ses clients un accès anticipé aux dernières versions de Mistral à long contexte et optimisées pour la périphérie.
Des capacités audio, de vision et de raisonnement renforcées
Le reste de la gamme apporte des capacités qui sont rarement réunies au sein d’une seule version.
De nouveaux modèles audio traitent la parole avec davantage de précision, de la transcription rapide aux commandes vocales multilingues qui fonctionnent sans connexion permanente au cloud.
Les systèmes axés sur la vision améliorent la façon dont les logiciels lisent les documents, transforment des captures d’écran en code fonctionnel et interprètent des séquences vidéo avec un contexte bien plus riche.
D’autres misent sur la résolution de problèmes, notamment la planification au long cours, l’utilisation d’outils en plusieurs étapes et les processus de recherche documentaire capables de suivre des entrées volumineuses. Le résultat est un ensemble de modèles qui peuvent s’intégrer aussi bien au traitement sur l’appareil qu’aux files de modération, aux outils d’automatisation et aux processus sectoriels reposant sur une compréhension multimodale plus riche.
Un parcours plus clair pour tester et déployer les derniers modèles
AWS déploie l’ensemble des outils de prise en charge avec les modèles d’IA, ce qui permet aux équipes de les essayer plus facilement puis de les mettre en production. L’API unifiée reste le point d’entrée : changer de modèle ou les comparer ne nécessite donc pas de remanier une application.
Les développeurs peuvent tout tester dans l’environnement de test de la console Bedrock ou intégrer directement les modèles à leurs systèmes au moyen des SDK AWS. Pour les équipes qui développent des agents, des frameworks comme Bedrock AgentCore et Strands Agents sont déjà configurés pour fonctionner avec ces nouvelles versions.
AWS étend également l’arsenal d’évaluation et de sécurité. Des garde-fous peuvent être appliqués à n’importe quel modèle entrant, tandis que la suite d’évaluation intégrée aide les équipes à comparer les différentes options avant d’en choisir une pour un usage donné.
Avec cette mise à jour désormais disponible, AWS entre dans sa prochaine phase : élargir l’accès à mesure que les clients commencent à tester les nouveaux modèles.
La dernière collaboration de Lyft avec Anthropic et AWS donne un aperçu de l’arrivée de l’IA agentique dans le service client à grande échelle.

