Gemini 3.6, 3.7 y 3.8 Flash cuestan ahora mismo 0,75 $ por millón de tokens de entrada y 3,75 $ por millón de tokens de salida. Es una tarifa introductoria que dura hasta el 31 de diciembre de 2026. El 1 de enero de 2027, los tres se duplican hasta 1,50 $/7,50 $. Si estás presupuestando un proyecto más allá de año nuevo, usa la cifra más alta.
Gemini 3.1 Pro Preview, el actual modelo insignia de razonamiento, no tiene ningún nivel gratuito, un dato genuinamente contraintuitivo, ya que el más antiguo Gemini 2.5 Pro sí lo mantiene. Si quieres prototipar gratis con un modelo de nivel Pro, necesitas el modelo antiguo, no el más nuevo.
La mayoría de los rastreadores de precios de terceros que revisamos están equivocados o desactualizados ahora mismo, de formas que importan: uno indica el precio posterior a 2027 de 3.6 Flash como el precio de hoy, otro cita un nombre de modelo ("Gemini 3 Pro Preview") que Google ya ha renombrado, y otros dos ni siquiera mencionan la generación 3.6/3.7/3.8 Flash.
Una "alerta de presupuesto" no es lo mismo que un tope de gasto. Varios desarrolladores han reportado facturas sorpresa de cuatro y cinco cifras porque las alertas de Google solo notifican, no detienen la facturación, a menos que configures por separado un tope de gasto duro a nivel de proyecto, una opción que Google añadió en 2026 tras una oleada de estos incidentes.
La tabla de precios actual, verificada contra la propia página de Google
Cada cifra de abajo procede de ai.google.dev/gemini-api/docs/pricing, con fecha de última actualización marcada por el propio Google como 4 de septiembre de 2026, verificada cruzándola con la página de precios empresariales de Google Cloud para los mismos modelos. Los precios son de nivel Standard, por 1 millón de tokens, en USD. Dos multiplicadores se aplican en casi todos los modelos de esta lista: el procesamiento por lotes (Batch) o Flex funciona al 50% de la tarifa Standard, y el procesamiento Priority cuesta 1,8 veces la tarifa Standard.
Model Input $/1M Output $/1M Free tier
------------------------------------------------------------------------
Gemini 3.1 Pro Preview $2.00 (<=200K) $12.00 (<=200K) None
$4.00 (>200K) $18.00 (>200K)
Gemini 3.8 Flash $0.75* $3.75* Yes (limited)
Gemini 3.7 Flash $0.75* $3.75* Yes (limited)
Gemini 3.6 Flash $0.75* $3.75* Yes (limited)
Gemini 3.5 Flash $1.50 $9.00 Yes (limited)
Gemini 3.5 Flash-Lite $0.30 $2.50 Yes (limited)
Gemini 3.1 Flash-Lite $0.25 / $0.50a $1.50 Yes (limited)
Gemini 3 Flash Preview $0.50 / $1.00a $3.00 Yes (limited)
Gemini 2.5 Pro $1.25 (<=200K) $10.00 (<=200K) Yes (limited)
$2.50 (>200K) $15.00 (>200K)
Gemini 2.5 Flash $0.30 / $1.00a $2.50 Yes (limited)
Gemini 2.5 Flash-Lite $0.10 / $0.30a $0.40 Yes (limited)
* Introductory price through 31 Dec 2026. Rises to $1.50 in / $7.50 out
on 1 Jan 2027 for all three Flash 3.6/3.7/3.8 models.
a Audio input is priced separately/higher than text, image, and video
input on these models - the second figure is the audio rate.Esta tabla cubre la gama de modelos de texto y razonamiento; las variantes en tiempo real Live, Omni, Transcribe y TTS-preview de Gemini se cobran por separado y quedan fuera del alcance aquí. El almacenamiento en caché de contexto está disponible en todos los modelos de arriba con un descuento de aproximadamente el 90% sobre la tarifa de entrada, más una cuota de almacenamiento por hora (normalmente entre 0,50 $ y 4,50 $ por millón de tokens por hora, más alta para los modelos de nivel Pro). Ninguna de las páginas de precios o facturación que Google publica para desarrolladores indica cifras explícitas de solicitudes por minuto o tokens por minuto; esas viven en una página de límites de tasa separada que cambia con la frecuencia suficiente como para que no reproduzcamos aquí una cifra concreta, solo señalar que los topes de RPM/TPM del nivel gratuito y de pago son reales y merece la pena comprobarlos directamente antes de construir en torno a un rendimiento asumido.

El precipicio de precio de enero de 2027 que casi nadie está señalando
Este es el dato más útil para cualquiera que esté presupuestando un proyecto impulsado por Gemini más allá de año nuevo, y es el que todos los rastreadores de terceros que revisamos o bien se equivocaron o directamente omitieron. Gemini 3.6, 3.7 y 3.8 Flash, los tres modelos sobre los que de verdad está construyendo la mayoría de desarrolladores ahora mismo, tienen todos un precio introductorio de 0,75 $ de entrada / 3,75 $ de salida por millón de tokens hasta el 31 de diciembre de 2026. El 1 de enero de 2027, esa tarifa se duplica hasta 1,50 $/7,50 $ en los tres. No es una subida de precio que Google esté planeando en silencio; ya está publicada en la propia página de precios actual, justo al lado de la tarifa vigente, y es fácil pasarla por alto porque la página la presenta como una nota a pie de página en vez de como un titular. Si el modelo de coste de tu proyecto asume que el precio actual de Flash se mantiene indefinidamente, no es así, y la duplicación no es pequeña: una carga de trabajo que cuesta hoy 750 $ al mes en tokens de salida de Flash pasará a costar 1.500 $ al mes desde enero.
La brecha del nivel gratuito: el Pro más nuevo no tiene ninguno
La disponibilidad del nivel gratuito no sigue una relación clara con lo nuevo o capaz que sea un modelo, y Gemini 3.1 Pro Preview es el ejemplo más claro. Es el actual modelo insignia de razonamiento, y no tiene ningún nivel gratuito en absoluto, ni siquiera una pequeña asignación con límite de tasa. Todos los modelos de nivel Flash, desde la preview heredada más antigua hasta el más nuevo 3.8 Flash, conservan algún tipo de acceso gratuito. Gemini 2.5 Pro, el modelo Pro de la generación anterior, también lo conserva. Así que si quieres prototipar gratis la calidad de razonamiento de un modelo de clase Pro antes de comprometer presupuesto, el camino práctico hoy es el 2.5 Pro más antiguo, no el más nuevo y mejor puntuado en benchmarks Gemini 3.1 Pro Preview, únicamente por cómo Google ha cerrado el acceso al nivel gratuito.
Facturación del nivel gratuito y cómo se desbloquean los niveles de pago
El acceso a la API de Gemini empieza con un nivel gratuito con límite de tasa disponible para cualquier proyecto activo, sin que haga falta una cuenta de facturación. Pasar al acceso de pago ocurre en niveles graduados, cada uno desbloqueando un tope mensual de facturación más alto, verificado a partir de la propia documentación de facturación de Google:
Tier Qualification Billing cap
----------------------------------------------------------------
Free Active project or free trial N/A
Tier 1 Link an active billing account $250
Tier 2 Paid $100+, 3 days after first payment $2,000
Tier 3 Paid $1,000+, 30 days after first payment $20,000-100,000+
Existen dos planes de facturación dentro de los niveles de pago: Postpay, el modelo tradicional de pago después del uso, y Prepay, añadido en 2026, que te permite cargar fondos por adelantado y tope el gasto en lo que hayas cargado, una opción materialmente más segura para cualquiera que se haya visto sorprendido antes por una factura inesperada (ver más abajo). Google también añadió topes de gasto duros a nivel de proyecto en 2026 que de verdad pausan el acceso a la API de un proyecto en cuanto se agota un presupuesto, algo distinto de las notificaciones de alerta de presupuesto más antiguas que solo te envían un correo después de los hechos.
Las herramientas de fundamentación cuestan aparte, y la asignación gratuita es más pequeña de lo que suena
Si tu caso de uso necesita que el modelo fundamente respuestas en resultados en vivo de Google Search o en datos de Google Maps, eso se factura por separado del uso de tokens. La fundamentación con Google Search da a los modelos Gemini 3.x una asignación compartida de 5.000 solicitudes gratuitas al mes en todos los modelos 3.x combinados, no por modelo, y luego 14 $ por cada 1.000 solicitudes. Los modelos Gemini 2.5 reciben en su lugar una asignación diaria más pequeña en vez de mensual: 1.500 solicitudes al día compartidas entre 2.5 Flash y Flash-Lite, más un RPD separado de 1.500 para 2.5 Pro, y luego 35 $ por cada 1.000 prompts fundamentados, aproximadamente 2,5 veces la tarifa de los modelos 3.x. La fundamentación con Google Maps es más barata por solicitud (25 $/1.000) con una asignación gratuita de 500 solicitudes/día en los modelos de nivel Flash o 10.000/día en Pro. Si tu app depende de la fundamentación para cada respuesta, esta suele ser la partida que domina la factura, no el precio base de los tokens.
Generación de imágenes y embeddings
Los modelos de imagen y embeddings de Google tienen precio con la misma tarifa de tokens de entrada que su contraparte de generación de texto, más un cargo separado por imagen de salida o por token de salida:
Model Input Image/embedding output
--------------------------------------------------------------------------
Gemini 3 Pro Image (Nano Banana Same as 3.1 $120/1M tok out =
Pro) Pro Preview $0.134/image (1K-2K),
$0.24/image (4K).
No free tier.
Gemini 3.1 Flash Image (Nano $0.50 (text) $60/1M tok out =
Banana 2) out $3.00 $0.045-$0.151/image
Gemini 2.5 Flash Image (Nano $0.30 $0.039/image (1024x1024)
Banana)
Gemini Embedding 2 (multimodal) text $0.20/1M, image $0.45/1M
($0.00012/img), audio $6.50/1M
($0.00016/sec), video $12.00/1M
($0.00079/frame). Free tier: yes.
Gemini Embedding (text-only) $0.15/1M. Free tier: yes.Lo que de verdad falla: las alertas no son topes, y las claves filtradas salen caras
El patrón en casi todas las historias reales de terror de facturación de la API de Gemini es la misma brecha: una alerta de presupuesto te notifica por correo, no detiene el contador. Los propios foros de la comunidad y los debates de desarrolladores de Google lo documentan una y otra vez. Un hilo del Google AI Developer Forum describe a un usuario al que se le facturaron unos 780 $ por 1.540 generaciones de vídeo Veo que dice que deberían haber producido unos 20 clips, calificando el volumen de "físicamente imposible" en la ventana de tiempo; el soporte de Google no resolvió del todo la disputa en el hilo. Una Discusión de GitHub en el repositorio gemini-cli describe a un desarrollador que añadió una clave de API a la CLI esperando uso de nivel gratuito: se acumuló una factura de 66 $ en tres días consumiendo 97 millones de tokens en una sola tarde, y luego, en una sesión posterior, otros 72 $ en unas cuatro horas, mucho más volumen de tokens en ambos casos del que el usuario creía que justificaba su uso real. Por separado, investigadores de seguridad de Truffle Security reportaron haber encontrado 2.863 claves de API de Google activas expuestas públicamente en la web que podían autenticarse ante la API de Gemini, porque cualquier clave vinculada a un proyecto con la API de Gemini activada se convierte en una credencial válida de Gemini, un detalle de diseño heredado más que un fallo específico de Gemini, pero que ha producido facturas reales por robo de decenas de miles de dólares reportadas por medios como The Register y Tom's Hardware.
La solución en todos los casos documentados es la misma: no confíes en los correos de alerta como tu red de seguridad. Configura un tope de gasto real a nivel de proyecto (añadido en 2026, y el único ajuste que detiene la facturación en vez de solo notificarte), rota cualquier clave de API que haya tocado alguna vez un repositorio público o código del lado del cliente, y considera la facturación Prepay si quieres un techo duro por diseño en vez de un ajuste que tengas que acordarte de configurar.
Por qué la calculadora de precios que encontraste en el buscador podría estar equivocada hoy
Revisamos varias de las páginas de precios de Gemini de terceros que posicionan bien para este tema frente a la propia fuente primaria de Google, y encontramos errores reales y concretos que vale la pena conocer si contrastas otras guías: el precio "actual" de un rastreador para Gemini 3.6 Flash es en realidad la tarifa posterior al aumento de enero de 2027, no la tarifa introductoria de hoy. Otro artículo, correcto en el precio para el modelo que describe, lo llama por un nombre, "Gemini 3 Pro Preview", que Google ya ha retirado en favor de "Gemini 3.1 Pro Preview", y además afirma que ese modelo no tiene descuento de batch ni de caché, lo cual ya no es cierto. Otras dos guías que revisamos simplemente no mencionan la generación 3.6, 3.7 o 3.8 Flash en absoluto, lo que significa que un lector que confiara en ellas no sabría que la gama Flash de nivel medio actual siquiera existe. Nada de esto es malicioso, las páginas de precios simplemente se quedan desactualizadas rápido en un mercado que lanza un nuevo modelo Flash cada tres semanas, pero es un buen motivo para comprobar una marca de fecha antes de fiarte de cualquier guía de precios, incluida esta; si estás leyendo esto bastante después de septiembre de 2026, vuelve a verificarlo contra la propia página de Google antes de comprometer presupuesto.
La gente también pregunta
¿Es gratis usar la API de Gemini?
La mayoría de los modelos de Gemini tienen un nivel gratuito con límite de tasa disponible para cualquier proyecto activo sin que haga falta cuenta de facturación, incluida la gama Flash actual (3.6, 3.7, 3.8 Flash) y Gemini 2.5 Pro. La excepción notable es Gemini 3.1 Pro Preview, el actual modelo insignia de razonamiento, que no tiene ningún nivel gratuito.
¿Cuánto cuesta Gemini 3.8 Flash?
0,75 $ por millón de tokens de entrada y 3,75 $ por millón de tokens de salida, una tarifa introductoria igual a la de 3.6 y 3.7 Flash, vigente hasta el 31 de diciembre de 2026. Desde el 1 de enero de 2027, el precio se duplica hasta 1,50 $/7,50 $.
¿Por qué mi factura de la API de Gemini fue mucho más alta de lo esperado?
La causa más reportada es confundir una alerta de presupuesto con un tope de gasto: las alertas solo te notifican después de que ocurra el uso, no detienen la facturación. Configura un tope de gasto explícito a nivel de proyecto o cambia a facturación Prepay (ambos añadidos por Google en 2026) si quieres un techo duro. Las claves de API filtradas o públicas son la otra causa principal de facturas sorpresa grandes.
¿Incluyen los precios de la API de Gemini la fundamentación con Google Search?
No, la fundamentación se factura por separado del uso de tokens. Los modelos Gemini 3.x reciben 5.000 solicitudes gratis de fundamentación con Search al mes compartidas entre todos los modelos 3.x, y luego 14 $ por cada 1.000 solicitudes. Los modelos 2.5 más antiguos reciben una asignación diaria gratuita más pequeña y pagan 35 $ por cada 1.000 solicitudes fundamentadas.
¿Es más barata la API de Gemini que GPT o Claude?
Depende mucho de qué modelo y nivel concretos compares, y los precios de los tres proveedores cambian cada pocas semanas, así que cualquier tabla comparativa única se queda desactualizada rápido. Compara los IDs de modelo y niveles exactos que planeas usar directamente en la página de precios actual de cada proveedor en vez de fiarte de una comparativa estática.