Calculadora de costes de la API de OpenAI

OpenAI cachea automáticamente los prefijos de prompt repetidos: no hay que marcar nada en la solicitud, y un acierto de caché se cobra a 5%–10% del precio de entrada en los modelos de abajo. En nuestros datos GPT-5.4 mini, GPT-5.4 nano no tienen tarifa de escritura en caché, así que un fallo cuesta lo mismo que la entrada normal, mientras que GPT-6.1 Sol, GPT-6 Astra, GPT-6 Luna tienen un precio de escritura de 1.25× la tarifa de entrada. GPT-5.5 Pro no tiene precio de entrada en caché, así que la caché no ahorra nada con él.

La Batch API quita 50% a la entrada y 50% a la salida a cambio de resultados asíncronos, y los tokens en caché dentro de un batch cuestan 50% de la tarifa normal en caché. Las tarifas de contexto largo se aplican por encima de 272K en GPT-6.1 Sol, GPT-6 Astra, GPT-5.5 Pro, GPT-6 Luna y 7 más (entrada 2×, salida 1.5×), a toda la solicitud. La palanca más grande es la gama del modelo: los modelos pro gastan más cómputo por respuesta y cobran mucho más por token, mini y nano cambian calidad por precio, y el modelo insignia queda en medio.

La tabla calcula una misma carga en cada modelo: 10,000 solicitudes al día con 6,000 tokens de entrada y 500 de salida por solicitud. Columnas: sin caché; 70% de la entrada leída de la caché y 5% escrita en ella; todas las solicitudes por la Batch API. Con el mismo tráfico, GPT-5.5 Pro cuesta 318× lo que GPT-6 Luna.

ModeloEstándar
10,000 sol./día · 6,000 entrada · 500 salida
Calcula con tus cifras →
Con prompt caching
10,000 sol./día · 6,000 entrada · 500 salida · caché 70%
Calcula con tus cifras →
Batch API
10,000 sol./día · 6,000 entrada · 500 salida · batch
Calcula con tus cifras →
GPT-6.1 Sol$5,100/mes$2,751/mes$2,550/mes
GPT-6 Astra$25,500/mes$14,385/mes$12,750/mes
GPT-5.5 Pro$81,000/mes$81,000/mes
sin caché
$40,500/mes
GPT-6 Luna$255/mes$144/mes$128/mes
GPT-5.4 mini$2,025/mes$1,174/mes$1,012/mes
GPT-5.4 nano$548/mes$321/mes$274/mes

Estimaciones con tarifas por token publicadas; verifica los precios oficiales antes de presupuestar. Datos sincronizados de la lista de precios de LiteLLM el 2026-10-08.

¿Cuándo compensa la caché con tu tráfico? Usa la calculadora de caché →

Preguntas frecuentes

¿Tengo que cambiar mi código para usar la caché de OpenAI?

No. La caché es automática cuando el prompt es lo bastante largo. Pon el contenido fijo (instrucciones, definiciones de herramientas, ejemplos) al principio y la parte variable al final para que el prefijo coincida entre solicitudes.

¿Cuándo compensa un modelo pro?

Cuando una respuesta equivocada cuesta más que los tokens extra: razonamiento difícil, revisiones críticas, poco volumen. En nuestros datos los modelos pro no tienen precio de entrada en caché, así que una app con mucho volumen paga la entrada completa en cada solicitud.

¿Uso mini o nano?

Nano sirve para clasificar, extraer y enrutar a gran volumen; mini maneja chat y razonamiento sencillo. Prueba ambos con tus prompts: un modelo más barato que necesita reintentos o prompts más largos puede acabar costando más.