Les agents IA peuvent travailler pendant des heures sans faire de pause. Malheureusement, ils peuvent aussi continuer à dépenser de l’argent pendant tout ce temps.
Google a lancé le 26 août une édition de Gemini Enterprise facturée à l’usage, offrant aux entreprises une alternative aux abonnements fixes par utilisateur. L’entreprise présente ce modèle à la consommation comme un moyen de tester les agents IA en limitant les engagements, tout en ajoutant des contrôles destinés à éviter des factures cloud exceptionnellement élevées.
Pour les acheteurs du secteur professionnel, la question essentielle est de savoir si le paiement à l’usage réduira les coûts ou s’il remplacera simplement des frais de licence prévisibles par une facture qui varie chaque mois.
Google ajoute une tarification à la consommation et des plafonds de dépenses
Dans le cadre des nouvelles options de facturation, les organisations peuvent combiner des abonnements classiques par poste avec un accès à l’usage.
L’édition à la consommation n’impose ni engagement initial ni frais d’abonnement de base. Les entreprises paient plutôt les ressources telles que les tokens, la mémoire, la puissance de calcul et le stockage aux tarifs standards de Google à l’usage.
Cela diffère de la remise sur l’API récemment couverte par eWeek, au moment où Gemini 3.7 Flash a été lancé. Cette annonce réduisait le coût d’utilisation d’un modèle donné. Le nouveau programme modifie la manière dont les entreprises peuvent payer pour l’application Gemini Enterprise au sens large et les charges de travail de ses agents.
Google présente la tarification à l’usage comme une option destinée aux organisations disposant d’au moins 20 postes. Cette édition est progressivement déployée et reste accessible à un groupe limité de clients.
Cette mise à jour offre également aux administrateurs plusieurs moyens de limiter les dépenses. Les entreprises peuvent définir des plafonds mensuels stricts au niveau du projet, recevoir des alertes lorsque les dépenses atteignent 50 %, 80 % et 100 % du budget, et choisir de mettre les charges de travail en pause ou de les poursuivre aux tarifs à la consommation après épuisement des quotas mutualisés ou atteinte d’une limite de dépenses.
Google mutualise également les quotas entre Gemini Enterprise, son environnement de développement Antigravity, Android Studio et les agents personnalisés. La capacité inutilisée achetée pour un groupe peut donc absorber une demande plus forte ailleurs dans l’organisation.
Ce qu’a constaté eWeek : les économies de la tarification à l’usage diminuent avec l’augmentation de l’utilisation
La tarification à l’usage peut être pertinente pour les projets pilotes, les projets saisonniers et les équipes dont la demande est irrégulière. Son avantage en matière de coûts peut toutefois se réduire lorsque les agents commencent à exécuter des charges de travail plus importantes et récurrentes.
Google indique que Gemini Enterprise Standard/Plus démarre à 30 dollars US par utilisateur et par mois. Le coût initial de l’abonnement s’élève donc à 750 dollars US par mois pour 25 postes, 3 000 dollars US par mois pour 100 postes ou 15 000 dollars US par mois pour 500 postes.
L’édition à l’usage ne comporte aucuns frais par poste et inclut les fonctionnalités de Standard/Plus, à une exception près pour le moment : Gemini Notebook n’est pas encore inclus, même si Google indique qu’il le sera ultérieurement. Les organisations doivent contacter Google pour connaître les tarifs et les critères d’éligibilité réels ; les chiffres ci-dessous sont donc indicatifs et ne constituent pas des devis clients complets.
L’alternative à la consommation n’a pas de tarif universel, car la facture dépend des modèles, du volume de tokens, de la mémoire, de la puissance de calcul, du stockage, de la région et de la charge de travail. Les calculs suivants d’eWeek utilisent les tarifs mondiaux Standard PayGo des tokens d’entrée et de sortie de Gemini 3.7 Flash afin d’illustrer l’influence du niveau d’utilisation sur la comparaison. Ils présentent une estimation des frais liés aux tokens du modèle, et non le coût total du déploiement de Gemini Enterprise.
Exemple de déploiement | Utilisation mensuelle indicative | Frais indicatifs mondiaux liés aux tokens jusqu’en 2026 | Frais indicatifs mondiaux liés aux tokens à partir de 2027 | Coût initial de Standard/Plus |
| Projet pilote de 25 personnes | 25 millions de tokens d’entrée et 2,5 millions de tokens de sortie | Environ 28 dollars US | Environ 56 dollars US | $750 |
| 100 utilisateurs actifs | 500 millions de tokens d’entrée et 50 millions de tokens de sortie | Environ 563 dollars US | Environ 1 125 dollars US | $3,000 |
| 500 utilisateurs intensifs | 5 milliards de tokens d’entrée et 500 millions de tokens de sortie | Environ 5 625 dollars US | Environ 11 250 dollars US | $15,000 |
Google facture 10 % de plus pour l’utilisation de Gemini 3.7 Flash Standard PayGo en dehors de la région mondiale. Les tarifs hors région mondiale sont de 0,825 dollar US par million de tokens d’entrée et de 4,125 dollars US par million de tokens de sortie jusqu’au 31 décembre 2026. Ces tarifs passeront respectivement à 1,65 et 8,25 dollars US le 1er janvier 2027.
Ces chiffres ne couvrent que les frais liés aux tokens d’entrée et de sortie. Google indique que les clients à l’usage peuvent également être facturés pour des ressources telles que la mémoire, la puissance de calcul et le stockage ; les calculs ne représentent donc pas les factures complètes de Gemini Enterprise. Ils ne tiennent pas non plus compte des allocations de quotas incluses dans les abonnements par poste.
Même avec ces limites, la comparaison illustre le compromis central. La tarification à la consommation peut produire des frais de tokens nettement inférieurs lorsque l’utilisation est limitée ou intermittente. À mesure que les charges de travail récurrentes des agents consomment davantage de tokens et d’autres ressources mesurées, l’écart entre la tarification à la consommation et celle par abonnement pourrait se réduire.
Les entreprises qui évaluent cette nouvelle option devraient mesurer la consommation réelle de ressources lors d’un projet pilote limité plutôt que d’estimer la demande en fonction des effectifs. Le guide des tarifs de l’IA d’eWeek montre à quel point les coûts peuvent varier selon les modèles et les niveaux de service.
Google propose des remises pour les charges de travail prévisibles
Pour les organisations dont la demande est stable, Google a lancé les Flexible Savings Plans, qui réduisent de 10 % le coût des tokens éligibles avec un engagement d’un an, ou de 20 % avec un engagement de trois ans. Les clients choisissent un montant de dépenses mensuel, mais l’engagement ne peut généralement pas être annulé ou modifié après l’achat.
Si l’utilisation éligible est inférieure au montant choisi, le client doit tout de même payer l’intégralité de l’engagement mensuel, et la part inutilisée n’est pas reportée. L’utilisation dépassant le montant engagé est facturée aux tarifs standards à la demande, sans bénéficier de la remise du plan.
Une tarification pour l’exécution différée sera également proposée pour certaines charges de travail. Les entreprises pourront signaler les tâches d’agents non urgentes afin qu’elles soient traitées en dehors des périodes de pointe, ce qui pourrait réduire les coûts d’inférence de jusqu’à 50 %.
Ces options apparaissent alors que Google continue de promouvoir des modèles plus compacts afin de réduire le coût des agents destinés aux entreprises. Son précédent lancement de Gemini 3.6 mettait lui aussi l’accent sur des modèles moins coûteux pour les charges de travail professionnelles à fort volume.
La nouvelle structure tarifaire pourrait réduire la barrière financière au lancement d’un projet pilote Gemini Enterprise en supprimant les frais par poste pour les clients participants. Elle n’élimine toutefois pas le risque de dépenses excessives lorsque les agents autonomes commencent à enchaîner les recherches, les appels d’outils et les requêtes adressées aux modèles.
Les entreprises les plus susceptibles d’en bénéficier seront celles qui traitent la consommation d’IA comme une infrastructure cloud : elles la mesurent, la plafonnent et vérifient que chaque charge de travail récurrente génère suffisamment de valeur pour justifier son coût.
Ce que cela signifie pour les acheteurs du secteur professionnel
Pour les responsables informatiques et financiers, le choix ne devrait pas commencer par le nombre d’employés susceptibles d’utiliser Gemini. Il devrait commencer par le volume et le type de travail que ces employés et ces agents sont censés effectuer.
Avant de s’engager, les entreprises devraient mener un projet pilote contrôlé et suivre la consommation de tokens, le choix des modèles, la mémoire, la puissance de calcul, le stockage et la fréquence des flux de travail automatisés. Elles devraient également tester les plafonds de dépenses afin de comprendre ce qui se passe lorsqu’un projet atteint sa limite et de déterminer quelles charges de travail peuvent être mises en pause sans perturber les opérations.
La responsabilité est également importante. Les équipes financières doivent avoir une visibilité sur la répartition des coûts, tandis que les administrateurs informatiques doivent définir les modèles et les flux de travail d’agents que les employés peuvent utiliser. Sans ces contrôles, un petit nombre de processus automatisés pourrait générer une part disproportionnée de la facture.
La tarification à l’usage pourrait constituer un meilleur point de départ pour une demande incertaine, saisonnière ou intermittente. Les abonnements par poste peuvent offrir une budgétisation plus prévisible aux équipes qui utilisent Gemini régulièrement et peuvent tirer pleinement parti de leurs quotas mutualisés. Les Flexible Savings Plans constituent une autre option pour les organisations capables de prévoir de manière fiable leur consommation mensuelle, même si les entreprises paient toujours le montant engagé lorsque l’utilisation est inférieure aux prévisions.
La comparaison la plus utile reposera donc sur les coûts mensuels complets, et non uniquement sur le prix des tokens ou le nombre d’employés. Les acheteurs devraient examiner chaque ressource mesurée, fonctionnalité incluse, allocation de quotas et durée d’engagement avant de décider quel modèle tarifaire offre le meilleur rapport valeur-prix.
À lire également : découvrez les principales annonces concernant Gemini et les agents IA lors de Google I/O 2026 et ce qu’elles révèlent de la stratégie plus large de Google en matière d’IA pour les entreprises.


