El anuncio de Google sobre Gemini 4 Argon indica un precio introductorio de $2 por millón de tokens de entrada y $10 por millón de tokens de salida en la API. También indica tarifas posteriores de $4 y $20, sin fecha de finalización para el periodo introductorio. La entrada en caché cuesta un 95% menos y la salida máxima aumenta de 64K a 1 millón de tokens.
Fuente: Google DeepMind. Esta tarjeta no muestra las tarifas de $2 y $10; esas tarifas aparecen en el texto del anuncio. La publicación de lanzamiento de Logan Kilpatrick también indica el precio introductorio en el texto, no en una tarjeta de precios separada.
Precio y límites de Gemini 4 Argon
| Especificación | Valor | Fuente y fecha de los datos |
|---|---|---|
| Entrada introductoria | $2 por 1M de tokens | Anuncio de Google, 30 de septiembre de 2026 |
| Salida introductoria | $10 por 1M de tokens | Anuncio de Google, 30 de septiembre de 2026 |
| Entrada posterior | $4 por 1M de tokens | Anuncio de Google; no se indica fecha de finalización |
| Salida posterior | $20 por 1M de tokens | Anuncio de Google; no se indica fecha de finalización |
| Entrada en caché | 95% de descuento sobre el precio de entrada | Anuncio de Google |
| Salida máxima | 1M de tokens, frente a 64K | Anuncio de Google |
| Ventana de contexto | 1M de tokens compartidos entre entrada y salida | Registro del modelo de Artificial Analysis, consultado el 5 de octubre |
Las tarifas de lanzamiento son los precios anunciados en ese momento, no una promesa de que el periodo promocional termine en una fecha concreta. La página sobre el estado del lanzamiento explica a quién ha mencionado Google para el acceso; según los datos consultados, los usuarios habituales no podían llamar a Argon.
Cómo funciona el descuento del 95% de la caché
“95% de descuento” significa que la entrada en caché cuesta el 5% de la tarifa de entrada publicada. Con la tarifa introductoria de $2, son aproximadamente $0.10 por millón de tokens de entrada en caché. Con la tarifa posterior de $4, son aproximadamente $0.20. El descuento se aplica a las lecturas de entrada en caché; no reduce el precio de salida.
En un cálculo hipotético, una solicitud con 100.000 tokens de entrada procesados por primera vez y 20.000 tokens de salida a las tarifas introductorias costaría $0.20 + $0.20 = $0.40 antes de considerar la caché. La entrada reutilizada se factura con la tarifa reducida cuando cumple los requisitos de caché; las solicitudes reales pueden tener recuentos de tokens y comportamientos de caché distintos.
La capacidad de salida no es la capacidad de contexto
El anuncio de Google eleva, en una sola respuesta, el límite de salida de 64K a 1M de tokens. El registro de Artificial Analysis también indica una ventana de contexto de 1M de tokens compartida entre entrada y salida. Son límites diferentes: la salida describe cuánto puede generar el modelo en una respuesta, mientras que el contexto describe la capacidad combinada disponible para una solicitud.
Un límite de salida de 1M no significa que una solicitud pueda usar 1M de tokens de entrada más 1M de salida a la vez. Da más margen a los trabajos largos antes de que se corte la respuesta, mientras que la calidad, la latencia y el número práctico de tokens de una tarea siguen dependiendo de la solicitud.
Lo que no te dice el precio publicado
Artificial Analysis indica un coste estimado de $1.99 por tarea del Intelligence Index. Es una estimación de evaluación ponderada, no una tarifa fija para clientes ni una previsión para todas las cargas de trabajo. Para las puntuaciones separadas por fuente, consulta los benchmarks de Gemini 4 Argon. Para la métrica detrás de la conocida cifra del 15,1 %, consulta qué significa la tasa de alucinación de Argon.
Si necesitas un modelo local sin una factura de API por token, descarga Gemma 4 y consulta sus opciones de configuración. Gemma 4 y Gemini 4 Argon son familias de modelos independientes.
Prueba Gemma 4 online
~/gemma4 $ Prueba Gemma 4 en el navegador antes de instalarlo en tu equipo.
Probar Gemma 4 />

