Tous les guides
Guide11 min de lecture · mis à jour 7 septembre 2026

Tarifs de l'API Gemini, expliqués (septembre 2026) : chaque modèle texte et image, et la hausse de prix cachée en évidence

Cherchez « tarifs API Gemini » et vous tomberez sur des simulateurs et guides de coût, plusieurs datant de mi-2026, citant un prix Flash vieux de deux générations ou, par accident, le prix que Google commencera à facturer en janvier 2027. Voici le tableau réel actuel, tiré directement des pages de tarification et de facturation de Google et recoupé ligne par ligne, plus la date que tout développeur travaillant avec Gemini en ce moment devrait avoir dans son agenda.

Réponse rapide

Gemini 3.6, 3.7 et 3.8 Flash coûtent tous actuellement 0,75 $ par million de tokens en entrée et 3,75 $ par million de tokens en sortie. C'est un tarif de lancement valable jusqu'au 31 décembre 2026. Le 1ᵉʳ janvier 2027, les trois doublent à 1,50 $ / 7,50 $. Si vous budgétez un projet au-delà du nouvel an, utilisez le chiffre le plus élevé.

Gemini 3.1 Pro Preview, le modèle de raisonnement phare actuel, n'a aucun palier gratuit du tout, un fait vraiment contre-intuitif, puisque l'ancien Gemini 2.5 Pro, lui, en a toujours un. Si vous voulez prototyper gratuitement sur un modèle de niveau Pro, il vous faut le modèle historique, pas le plus récent.

La plupart des simulateurs de tarifs tiers que nous avons vérifiés sont faux ou obsolètes en ce moment, et ça compte : l'un affiche le prix post-2027 de 3.6 Flash comme le prix actuel, un autre cite un nom de modèle (« Gemini 3 Pro Preview ») que Google a depuis renommé, et deux autres ne mentionnent même pas la génération Flash 3.6/3.7/3.8.

Une « alerte de budget » n'est pas la même chose qu'un plafond de dépense. Plusieurs développeurs ont signalé des factures surprises à quatre et cinq chiffres parce que les alertes de Google ne font que notifier, elles n'arrêtent pas la facturation, à moins de configurer séparément un plafond de dépense strict au niveau du projet, une option que Google a ajoutée en 2026 après une vague de ces incidents.

Le tableau de tarifs actuel, vérifié sur la propre page de Google

Chaque chiffre ci-dessous provient de ai.google.dev/gemini-api/docs/pricing, daté par Google lui-même comme dernière mise à jour le 4 septembre 2026, recoupé avec la page de tarification entreprise de Google Cloud pour les mêmes modèles. Les prix sont ceux du palier Standard, par million de tokens, en dollars US. Deux multiplicateurs s'appliquent sur presque tous les modèles de cette liste : le traitement Batch ou Flex tourne à 50 % du tarif Standard, et le traitement Priority coûte 1,8 fois le tarif Standard.

Model                        Input $/1M      Output $/1M     Free tier
------------------------------------------------------------------------
Gemini 3.1 Pro Preview       $2.00 (<=200K)  $12.00 (<=200K)  None
                              $4.00 (>200K)   $18.00 (>200K)
Gemini 3.8 Flash             $0.75*          $3.75*           Yes (limited)
Gemini 3.7 Flash             $0.75*          $3.75*           Yes (limited)
Gemini 3.6 Flash             $0.75*          $3.75*           Yes (limited)
Gemini 3.5 Flash             $1.50           $9.00            Yes (limited)
Gemini 3.5 Flash-Lite        $0.30           $2.50            Yes (limited)
Gemini 3.1 Flash-Lite        $0.25 / $0.50a  $1.50            Yes (limited)
Gemini 3 Flash Preview       $0.50 / $1.00a  $3.00            Yes (limited)
Gemini 2.5 Pro               $1.25 (<=200K)  $10.00 (<=200K)  Yes (limited)
                              $2.50 (>200K)   $15.00 (>200K)
Gemini 2.5 Flash             $0.30 / $1.00a  $2.50            Yes (limited)
Gemini 2.5 Flash-Lite        $0.10 / $0.30a  $0.40            Yes (limited)

* Introductory price through 31 Dec 2026. Rises to $1.50 in / $7.50 out
  on 1 Jan 2027 for all three Flash 3.6/3.7/3.8 models.
a Audio input is priced separately/higher than text, image, and video
  input on these models - the second figure is the audio rate.

Ce tableau couvre la gamme de modèles texte et raisonnement ; les variantes Live, Omni, Transcribe et TTS-preview de Gemini en temps réel sont tarifées séparément et hors du périmètre ici. La mise en cache de contexte est disponible sur chaque modèle ci-dessus avec une remise d'environ 90 % sur le tarif d'entrée, plus des frais de stockage horaires (typiquement 0,50 $ à 4,50 $ par million de tokens par heure, plus élevés pour les modèles de niveau Pro). Aucune des pages de tarification ou de facturation que Google publie pour les développeurs n'indique de chiffres explicites de requêtes par minute ou de tokens par minute ; ces chiffres se trouvent sur une page de limites de débit séparée et changent assez souvent pour qu'on ne réimprime pas un chiffre précis ici, on signale simplement que les plafonds RPM/TPM du palier gratuit et du palier payant sont réels et méritent d'être vérifiés directement avant de construire un projet autour d'un débit supposé.

La page officielle de tarification de l'API Gemini Developer de Google, montrant la liste des avantages du palier gratuit et une bannière annonçant que Gemini 3.8 Flash est désormais disponible.
ai.google.dev/gemini-api/docs/pricing, septembre 2026.

La falaise tarifaire de janvier 2027 que presque personne ne signale

C'est le fait le plus utile pour quiconque budgète un projet propulsé par Gemini au-delà du nouvel an, et c'est celui que chaque simulateur tiers que nous avons vérifié a soit mal indiqué, soit complètement omis. Gemini 3.6, 3.7 et 3.8 Flash, les trois modèles sur lesquels la plupart des développeurs construisent réellement en ce moment, sont tous tarifés à un tarif de lancement de 0,75 $ en entrée / 3,75 $ en sortie par million de tokens jusqu'au 31 décembre 2026. Le 1ᵉʳ janvier 2027, ce tarif double à 1,50 $ / 7,50 $ pour les trois. Ce n'est pas une hausse de prix que Google prépare discrètement ; c'est déjà publié sur la page de tarification actuelle, juste à côté du tarif en vigueur, et c'est facile à manquer parce que la page le présente comme une note de bas de page plutôt qu'un titre. Si le modèle de coût de votre projet suppose que la tarification Flash d'aujourd'hui tiendra indéfiniment, ce n'est pas le cas, et le doublement n'est pas anodin : une charge de travail coûtant 750 $ par mois en tokens de sortie Flash aujourd'hui coûtera 1 500 $ par mois à partir de janvier.

L'écart de palier gratuit : le plus récent modèle Pro n'en a aucun

La disponibilité du palier gratuit ne suit pas proprement la nouveauté ou la capacité d'un modèle, et Gemini 3.1 Pro Preview en est l'exemple le plus clair. C'est le modèle de raisonnement phare actuel, et il n'a aucun palier gratuit du tout, pas même une petite allocation limitée en débit. Chaque modèle de niveau Flash, du plus ancien aperçu historique au tout récent 3.8 Flash, conserve une forme d'accès gratuit. Gemini 2.5 Pro, le modèle Pro de la génération précédente, aussi. Donc si vous voulez prototyper gratuitement sur la qualité de raisonnement d'un modèle de classe Pro avant d'engager un budget, le chemin pratique aujourd'hui est l'ancien 2.5 Pro, pas le plus récent et mieux benchmarké 3.1 Pro Preview, purement à cause de la façon dont Google a verrouillé le palier gratuit.

Facturation du palier gratuit et déverrouillage des paliers payants

L'accès à l'API Gemini démarre sur un palier gratuit, limité en débit, disponible pour tout projet actif, sans compte de facturation requis. Le passage à l'accès payant se fait par paliers gradués, chacun déverrouillant un plafond de facturation mensuel plus élevé, vérifié depuis la propre documentation de facturation de Google :

Tier    Qualification                              Billing cap
----------------------------------------------------------------
Free    Active project or free trial                  N/A
Tier 1  Link an active billing account                 $250
Tier 2  Paid $100+, 3 days after first payment          $2,000
Tier 3  Paid $1,000+, 30 days after first payment       $20,000-100,000+
La page officielle de documentation de facturation de l'API Gemini de Google, montrant le tableau des paliers d'usage (Free, Tier 1 à 250 $, Tier 2 à 2 000 $) et une table des matières listant les plafonds de dépense et les plans de facturation Prepay/Postpay.
ai.google.dev/gemini-api/docs/billing, septembre 2026.

Deux plans de facturation existent au sein des paliers payants : Postpay, le modèle traditionnel de paiement après usage, et Prepay, ajouté en 2026, qui permet de charger des fonds à l'avance et plafonne la dépense à ce que vous avez chargé, une option nettement plus sûre pour quiconque a déjà été échaudé par une facture surprise (voir plus bas). Google a aussi ajouté en 2026 des plafonds de dépense stricts au niveau du projet qui suspendent réellement l'accès API d'un projet une fois un budget épuisé, à distinguer des anciennes notifications d'alerte de budget qui se contentent de vous envoyer un e-mail après coup.

Les outils d'ancrage coûtent en plus, et l'allocation gratuite est plus petite qu'il n'y paraît

Si votre cas d'usage exige que le modèle ancre ses réponses dans des résultats Google Search en direct ou des données Google Maps, c'est facturé séparément de l'usage de tokens. L'ancrage Google Search donne aux modèles Gemini 3.x une allocation gratuite partagée de 5 000 requêtes par mois pour l'ensemble des modèles 3.x combinés, pas par modèle, puis 14 $ pour 1 000 requêtes. Les modèles Gemini 2.5 reçoivent une allocation quotidienne plus petite au lieu d'une allocation mensuelle : 1 500 requêtes par jour partagées entre 2.5 Flash et Flash-Lite, plus un quota séparé de 1 500 RPD pour 2.5 Pro, puis 35 $ pour 1 000 requêtes ancrées, environ 2,5 fois le tarif des modèles 3.x. L'ancrage Google Maps est moins cher par requête (25 $/1 000) avec une allocation gratuite de 500 requêtes/jour sur les modèles de niveau Flash ou 10 000/jour sur Pro. Si votre application s'appuie sur l'ancrage pour chaque réponse, c'est fréquemment ce poste, pas le prix de base des tokens, qui domine la facture.

Génération d'images et embeddings

Les modèles d'images et d'embeddings de Google sont tarifés avec le même taux de tokens en entrée que leur équivalent en génération de texte, plus un tarif séparé par image ou par token de sortie :

Model                              Input        Image/embedding output
--------------------------------------------------------------------------
Gemini 3 Pro Image (Nano Banana    Same as 3.1  $120/1M tok out =
  Pro)                              Pro Preview   $0.134/image (1K-2K),
                                                   $0.24/image (4K).
                                                   No free tier.
Gemini 3.1 Flash Image (Nano       $0.50 (text) $60/1M tok out =
  Banana 2)                        out $3.00     $0.045-$0.151/image
Gemini 2.5 Flash Image (Nano       $0.30        $0.039/image (1024x1024)
  Banana)
Gemini Embedding 2 (multimodal)    text $0.20/1M, image $0.45/1M
                                    ($0.00012/img), audio $6.50/1M
                                    ($0.00016/sec), video $12.00/1M
                                    ($0.00079/frame). Free tier: yes.
Gemini Embedding (text-only)       $0.15/1M. Free tier: yes.

Ce qui casse vraiment : les alertes ne sont pas des plafonds, et les clés qui fuitent coûtent cher

Le schéma récurrent derrière presque toutes les vraies histoires d'horreur de facturation API Gemini est le même écart : une alerte de budget vous notifie par e-mail, elle n'arrête pas le compteur. Les propres forums communautaires et discussions de développeurs de Google documentent ça à répétition. Un fil du forum Google AI Developer décrit un utilisateur facturé environ 780 $ pour 1 540 générations vidéo Veo qui, selon lui, auraient dû produire environ 20 clips, qualifiant le volume de « physiquement impossible » dans la fenêtre de temps concernée ; le support Google n'a pas pleinement résolu le litige dans le fil. Une discussion GitHub sur le dépôt gemini-cli décrit un développeur ayant ajouté une clé API au CLI en s'attendant à un usage de palier gratuit : une facture de 66 $ accumulée sur trois jours en consommant 97 millions de tokens en un seul après-midi, puis, lors d'une session suivante, 72 $ de plus en environ quatre heures, un volume de tokens bien supérieur dans les deux cas à ce que l'utilisateur estimait être son usage réel. Séparément, des chercheurs en sécurité de Truffle Security ont rapporté avoir trouvé 2 863 clés API Google actives exposées publiquement sur le web pouvant s'authentifier auprès de l'API Gemini, parce que toute clé liée à un projet ayant l'API Gemini activée devient un identifiant Gemini valide, un détail de conception hérité plutôt qu'un bug propre à Gemini, mais qui a produit de vraies factures de vol allant jusqu'à des dizaines de milliers de dollars, rapportées notamment par The Register et Tom's Hardware.

La solution est la même dans chaque cas documenté : ne comptez pas sur les e-mails d'alerte comme filet de sécurité. Configurez un vrai plafond de dépense au niveau du projet (ajouté en 2026, et le seul réglage qui arrête réellement la facturation plutôt que de simplement vous en notifier), faites tourner toute clé API ayant déjà touché un dépôt public ou du code côté client, et envisagez la facturation Prepay si vous voulez un plafond strict par conception plutôt qu'un réglage à se souvenir de configurer.

Pourquoi le simulateur de tarifs trouvé dans une recherche pourrait être faux aujourd'hui

Nous avons vérifié plusieurs des pages de tarification Gemini tierces bien classées sur ce sujet par rapport à la propre source primaire de Google, et trouvé de vraies erreurs précises à connaître si vous recoupez d'autres guides : le prix « actuel » d'un simulateur pour Gemini 3.6 Flash est en réalité le tarif post-hausse de janvier 2027, pas le tarif de lancement actuel. Un autre article, précis côté prix pour le modèle qu'il décrit, s'y réfère sous un nom, « Gemini 3 Pro Preview », que Google a depuis retiré au profit de « Gemini 3.1 Pro Preview », et affirme séparément que ce modèle n'a pas de remise batch ou de mise en cache, ce qui n'est plus vrai. Deux autres guides que nous avons vérifiés ne mentionnent tout simplement pas la génération Flash 3.6, 3.7 ou 3.8, ce qui veut dire qu'un lecteur s'y fiant ne saurait même pas que la gamme Flash mi-tier actuelle existe. Rien de tout ça n'est malveillant, les pages de tarification deviennent simplement obsolètes vite sur un marché qui livre un nouveau modèle Flash toutes les trois semaines, mais c'est une bonne raison de vérifier une date avant de faire confiance à un guide de tarification, y compris celui-ci ; si vous lisez ceci bien après septembre 2026, revérifiez sur la propre page de Google avant d'engager un budget.

Questions fréquentes

L'API Gemini est-elle gratuite à utiliser ?

La plupart des modèles Gemini ont un palier gratuit, limité en débit, disponible pour tout projet actif sans compte de facturation requis, y compris la gamme Flash actuelle (3.6, 3.7, 3.8 Flash) et Gemini 2.5 Pro. La seule exception notable est Gemini 3.1 Pro Preview, le modèle de raisonnement phare actuel, qui n'a aucun palier gratuit du tout.

Combien coûte Gemini 3.8 Flash ?

0,75 $ par million de tokens en entrée et 3,75 $ par million de tokens en sortie, un tarif de lancement identique à 3.6 et 3.7 Flash, en vigueur jusqu'au 31 décembre 2026. À partir du 1ᵉʳ janvier 2027, le prix double à 1,50 $ / 7,50 $.

Pourquoi ma facture API Gemini est-elle arrivée bien plus élevée que prévu ?

La cause la plus souvent rapportée est la confusion entre une alerte de budget et un plafond de dépense : les alertes ne font que notifier après l'usage, elles n'arrêtent pas la facturation. Configurez un plafond de dépense explicite au niveau du projet ou passez à la facturation Prepay (les deux ajoutés par Google en 2026) si vous voulez un plafond strict. Les clés API divulguées ou publiques sont l'autre cause majeure de grosses factures surprises.

Les tarifs de l'API Gemini incluent-ils l'ancrage Google Search ?

Non, l'ancrage est facturé séparément de l'usage de tokens. Les modèles Gemini 3.x reçoivent 5 000 requêtes d'ancrage Search gratuites par mois partagées entre tous les modèles 3.x, puis 14 $ pour 1 000 requêtes. Les modèles 2.5 plus anciens reçoivent une allocation gratuite quotidienne plus petite et paient 35 $ pour 1 000 requêtes ancrées.

Les tarifs de l'API Gemini sont-ils moins chers que GPT ou Claude ?

Ça dépend fortement du modèle et du palier spécifiques comparés, et la tarification des trois fournisseurs change toutes les quelques semaines, donc tout tableau comparatif unique devient vite obsolète. Comparez les identifiants de modèle et les paliers exacts que vous prévoyez d'utiliser directement sur la page de tarification actuelle de chaque fournisseur plutôt que de vous fier à un tableau comparatif statique.

Continuer la lecture