Gemini 3.8 Flash mantiene el precio, pero duplicará la tarifa en enero

Google lanzó Gemini 3.8 Flash el 2 de septiembre de 2026 con disponibilidad general y una tarifa introductoria de 0,75 dólares por millón de tokens de entrada y 3,75 dólares por millón de salida. La cobertura de Ars Technica confirma que esos precios regirán hasta finales de 2026 y después pasarán a 1,50 y 7,50 dólares, respectivamente.
Ese lanzamiento del 2 de septiembre también incluyó Gemini 3.8 Flash Cyber, pero con un estado distinto: el modelo general puede utilizarse en Google AI Studio y mediante la API, mientras Cyber queda limitado a defensores admitidos en Fairwind. El análisis técnico de DataCamp recoge esa diferencia de disponibilidad y advierte que 3.8 Flash puede consumir más tokens cuando aumenta el esfuerzo de razonamiento.
El precio por token se mantiene solo hasta diciembre

Las tarifas pagadas estándar de Gemini 3.8 Flash igualan temporalmente las de 3.7 Flash. El 1 de enero de 2027, tanto la entrada como la salida costarán exactamente el doble; por ello, una carga que mantenga el mismo volumen de tokens también duplicará la parte de su factura correspondiente al modelo.
La salida tiene más peso en el cálculo: cuesta cinco veces más que la entrada en los dos periodos e incluye los tokens de razonamiento. Un agente que genere respuestas extensas, repita llamadas a herramientas o mantenga ciclos autónomos puede gastar más por tarea aunque la tarifa unitaria sea idéntica a la de 3.7 Flash.
El precio publicado permite calcular el efecto puro del cambio de enero, pero no anticipa el coste de una aplicación completa. Almacenamiento en caché, procesamiento por lotes, servicios externos y descuentos empresariales siguen condiciones propias; además, el número de tokens depende de la carga y del nivel de esfuerzo seleccionado.
Tres escenarios separan la tarifa del consumo

Estos ejemplos son condicionales y aplican únicamente las tarifas estándar publicadas. Suponen que cada tarea conserva el mismo consumo antes y después del 1 de enero y no incluyen caché, procesamiento por lotes ni cargos por herramientas externas.
- Tarea breve: un millón de tokens de entrada y 200.000 de salida cuestan 1,50 dólares hasta diciembre: 0,75 por la entrada y 0,75 por la salida. Desde enero, el total sería de 3 dólares.
- Agente intermedio: dos millones de tokens de entrada y 800.000 de salida cuestan 4,50 dólares durante el periodo introductorio. Con las tarifas de enero, la misma ejecución costaría 9 dólares.
- Flujo prolongado: cinco millones de tokens de entrada y dos millones de salida cuestan 11,25 dólares antes del cambio. Desde el 1 de enero, ascenderían a 22,50 dólares.
Los cálculos aíslan la subida tarifaria; no prueban que 3.8 Flash vaya a consumir lo mismo que 3.7. Si, en un ejemplo hipotético, una tarea utilizara un 25% más de tokens con 3.8, su coste sería un 25% mayor incluso durante el periodo en que ambos modelos comparten precios unitarios. También podría ocurrir lo contrario si la nueva versión completa el trabajo con menos reintentos, pero no existe un multiplicador público aplicable a todas las cargas.
Más esfuerzo puede significar más tokens por tarea
Gemini 3.8 Flash está orientado a ingeniería de software de larga duración, agentes autónomos y procesos empresariales de varios pasos. Google explica la mejora mediante ejecuciones con pasos adicionales de razonamiento y llamadas iterativas a herramientas; por tanto, “mismo precio por token” no equivale necesariamente a “mismo coste por resultado”.
El modelo permite ajustar el esfuerzo entre niveles bajo, medio y alto. Reducirlo puede limitar la sobrecarga de tokens cuando importan más la latencia y el gasto, mientras los niveles superiores buscan mejorar el desempeño en problemas complejos a cambio de un consumo potencialmente mayor.
La comparación con 3.7 Flash depende así de la carga medida, no solo de una tabla de precios o de un benchmark. Para evaluar el cambio hacen falta resultados aceptados, tokens totales, latencia, llamadas a herramientas y reintentos obtenidos bajo las mismas condiciones. Google mantiene 3.7 Flash soportado para cargas centradas en eficiencia y no ha anunciado una fecha de retirada.
Flash Cyber combina resultados propios con acceso restringido

Gemini 3.8 Flash Cyber comparte la inteligencia de base del modelo general, pero está especializado en descubrimiento de vulnerabilidades y generación de parches. El anuncio oficial de Google limita su acceso mediante Fairwind a defensores de confianza, entre ellos autoridades públicas, operadores de infraestructura crítica y mantenedores de software.
La tasa superior al 70% procede de una evaluación interna de Google sobre descubrimiento de vulnerabilidades en bases de código que abarcan 20 lenguajes. No es un resultado de CWE-Bench: esa prueba externa, administrada por Collinear y centrada en parcheo, asigna a Flash Cyber un 47,2% de pass@1 frente al 47,8% de otro modelo de frontera citado por Google.
Las dos cifras describen tareas y metodologías distintas, por lo que no deben combinarse como una única medida de eficacia. Además, siguen siendo resultados comunicados por Google; todavía hacen falta reproducciones independientes para saber cómo se trasladan a repositorios y entornos defensivos diferentes.
El estado confirmado tras el lanzamiento es, por tanto, doble: Gemini 3.8 Flash está disponible de forma general con precios introductorios hasta el 31 de diciembre, mientras Flash Cyber continúa bajo acceso controlado. El siguiente cambio ya fechado llegará el 1 de enero de 2027, cuando las tarifas estándar de entrada y salida del modelo general se duplicarán.
Lee también:
Suscríbete a nuestro boletín
Reciba las últimas noticias sobre Web3, IA y criptomonedas directamente en su bandeja de entrada.