Le 5 février, Google a étendu la disponibilité de son modèle d’IA générative Gemini 2.0 Flash mis à jour à l’API Gemini, achevant ainsi le déploiement du modèle conçu pour offrir une faible latence et de meilleures performances grâce au « raisonnement » de l’IA. Les utilisateurs de l’application Gemini sur ordinateur comme sur mobile ont obtenu l’accès à Gemini 2.0 Flash la semaine dernière.
Gemini 2.0 Flash est désormais disponible via l’API de Google
Les développeurs peuvent accéder à Gemini 2.0 Flash dans Google AI Studio et Vertex AI. Le tarif dépend du type d’entrée et de sortie, ainsi que du type d’abonnement à Google AI Studio ou Vertex AI. Les détails sont disponibles sur le blog des développeurs.
Gemini 2.0 Flash offre une fenêtre de contexte d’un million de tokens (600 000 à 800 000 mots anglais, bien que certains mots comptent comme un seul token). Comme OpenAI o3 ou le modèle R1 de DeepSeek, Gemini 2.0 Flash est conçu pour ralentir certains de ses processus de prédiction générative afin de « raisonner » sur des problèmes relativement complexes de programmation, de mathématiques et de sciences.
2.0 Pro Experimental révèle le meilleur de Gemini
Google prépare plusieurs autres versions de Gemini 2.0 : la variante Flash standard, Gemini 2.0 Flash-Lite et Gemini 2.0 Pro Experimental. La version Experimental est la dernière à être proposée au grand public ; les utilisateurs peuvent y accéder dans Google AI Studio, Vertex AI et l’application Gemini avec un abonnement Gemini Advanced. Google a indiqué que Gemini 2.0 Pro Experimental obtient de meilleurs résultats que ses homologues sur des tests comme MMLU-Pro et LiveCodeBench.
Gemini 2.0 Flash-Lite est disponible en aperçu public
À mi-chemin entre Gemini 1.5 Flash et Gemini 2.0 Flash se trouve 2.0 Flash-Lite, qui s’approche des performances de la version 2.0 tout en conservant le prix de la version 1.5. Les utilisateurs de Google AI Studio et de Vertex AI peuvent trouver 2.0 Flash-Lite en aperçu public.
La place de Gemini 2.0 dans l’évolution de l’approche de Google en matière de responsabilité de l’IA
Les nouvelles options de disponibilité de Gemini 2.0 sont apparues peu après que Google a mis à jour sa politique de sécurité de l’IA afin de supprimer les passages interdisant des usages tels que les armes et la surveillance.
Dans l’article de blog associé, l’équipe Gemini a déclaré avoir utilisé de nouvelles techniques d’apprentissage par renforcement pour apprendre à Gemini à se contrôler lui-même, améliorant ainsi ses réponses et, en particulier, en l’aidant à cibler les réponses souhaitées aux « prompts sensibles ».
« Nous tirons également parti du red teaming automatisé pour évaluer les risques liés à la sûreté et à la sécurité, notamment ceux posés par l’injection indirecte de prompts, un type de cyberattaque qui consiste pour les attaquants à dissimuler des instructions malveillantes dans des données susceptibles d’être récupérées par un système d’IA », a écrit Koray Kavukcuoglu, directeur technique de Google DeepMind, dans l’article de blog.

