Google a officiellement présenté Gemini 3.1 Pro, la dernière mise à jour de sa famille de modèles Gemini 3.
L’entreprise décrit cette version comme l’intelligence centrale améliorée qui se trouve derrière la mise à jour Gemini 3 Deep Think de la semaine dernière, et affirme qu’elle met désormais ces progrès à la portée d’un public plus large. Cette sortie marque la tentative de Google de reprendre la première place dans la course à l’IA, très disputée et concurrentielle, une position que l’entreprise s’est disputée ces derniers mois avec OpenAI et Anthropic.
Dans un billet de blog annonçant le modèle, Google a déclaré : « 3.1 Pro représente une avancée en matière de raisonnement de base. » L’entreprise a ajouté que le modèle constituait « une référence de base plus intelligente et plus performante pour la résolution de problèmes complexes ».
Conçu pour les problèmes qui nécessitent davantage qu’une réponse rapide
Gemini 3.1 Pro privilégie un raisonnement plus approfondi plutôt que de simples réponses. Google indique que le modèle est destiné aux situations « où une réponse simple ne suffit pas », notamment la recherche, les flux de travail d’ingénierie, la synthèse de données et les travaux créatifs avancés.
L’amélioration la plus importante concerne les performances en logique.
Sur le benchmark ARC-AGI-2, un test conçu pour mesurer la capacité de l’IA à gérer des schémas de raisonnement inconnus, le modèle a obtenu 77,1 %, soit plus de deux fois les performances de Gemini 3 Pro. Google a confirmé que ce résultat reflétait un bond significatif dans la capacité du système à résoudre de nouveaux problèmes étape par étape.
Le modèle a également obtenu de solides résultats sur d’autres métriques : 94,3 % sur GPQA Diamond, qui évalue les connaissances scientifiques, et 80,6 % sur SWE-Bench Verified, pour les tâches de programmation. Des évaluations indépendantes menées par Artificial Analysis le classent déjà en tête du peloton.
L’entreprise affirme que ce gain en matière de raisonnement se traduit par des résultats concrets. Parmi les exemples partagés par Google figurent la génération de SVG animés à partir d’invites textuelles, la configuration d’un tableau de bord aéronautique en direct visualisant l’orbite de la Station spatiale internationale, ainsi que la création d’expériences interactives immersives, comme une murmuration d’étourneaux en 3D contrôlée par suivi des mains.
Google a également mis en avant des tâches de programmation créative, notamment la conception d’un site web moderne inspiré des Hauts de Hurlevent d’Emily Brontë, dans lequel le modèle interprète le ton et le thème au lieu de simplement résumer le texte.
Selon la fiche du modèle publiée par Google DeepMind, Gemini 3.1 Pro est un système de « raisonnement nativement multimodal » capable de traiter du texte, des images, de l’audio, de la vidéo et de vastes bases de code. Il prend en charge une fenêtre de contexte allant jusqu’à 1 million de tokens et produit des sorties pouvant atteindre 64 000 tokens, ce qui permet d’analyser de grands jeux de données ou de longs flux de travail en une seule session.
Attendez, est-il meilleur dans tous les domaines ?
Pas tout à fait. Les données des benchmarks montrent quelques domaines dans lesquels la nouvelle version a en réalité légèrement régressé. Sur MMMU Pro, un test de compréhension multimodale, Gemini 3 Pro devance encore légèrement le nouveau modèle, avec 81,0 % contre 80,5 %. Et sur Humanity’s Last Exam avec prise en charge des outils, Opus 4.6 d’Anthropic a pris la première place.
Les évaluations de sécurité ont également révélé de légères fluctuations. Selon la documentation de DeepMind, la sécurité de la conversion d’image en texte a baissé de 0,33 % par rapport à la version précédente, même si l’entreprise a précisé qu’un examen manuel avait confirmé que la plupart des cas signalés étaient soit des faux positifs, soit en réalité dépourvus de problème. Les refus injustifiés, ces moments où un modèle refuse à tort de répondre, se sont légèrement améliorés de 0,08 %.
« Nous continuons d’améliorer nos évaluations internes, notamment en affinant les évaluations automatisées afin de réduire les faux positifs et les faux négatifs », a indiqué l’équipe de DeepMind dans sa documentation.
Qui peut l’utiliser dès maintenant
Le déploiement est plus large que d’habitude pour une mise à jour intermédiaire.
Les particuliers peuvent accéder à 3.1 Pro dans l’application Gemini dès aujourd’hui, tandis que les utilisateurs de NotebookLM disposant des forfaits Pro et Ultra y ont également accès. Pour les développeurs, le modèle est disponible en préversion via Google AI Studio, l’API Gemini et même dans Android Studio. Les entreprises peuvent le trouver dans Vertex AI et Gemini Enterprise.
Google parle pour l’instant d’une « préversion », afin de recueillir les retours des utilisateurs avant d’en faire la norme officielle.
Pour en savoir plus sur les ambitions de Google dans l’IA, découvrez comment Gemini Lyria 3 se lance dans la génération musicale assistée par l’IA.

