Precios de contexto largo

Varios proveedores suben el precio por token cuando un prompt supera un umbral (200K, 256K o 272K tokens). La tabla muestra el precio normal → contexto largo por 1M de tokens y el coste de un prompt de 500K tokens con una respuesta de 2K.

ModeloUmbralEntrada /1MSalida /1MUna solicitud de 500K
GPT-6 Luna272K$0.10 → $0.20$0.50 → $0.75$0.10
Qwen Flash256K$0.05 → $0.25$0.40 → $2.00$0.13
GPT-5.6 Luna272K$0.20 → $0.40$1.20 → $1.80$0.20
Qwen3.5 Plus256K$0.40 → $0.50$2.40 → $3.00$0.26
Qwen3.7 Plus256K$0.40 → $1.20$1.60 → $4.80$0.61
Grok Build 0.1200K$1.00 → $2.00$2.00 → $4.00$1.01
Grok Code Fast 1200K$1.00 → $2.00$2.00 → $4.00$1.01
Gemini 2.5 Pro200K$1.25 → $2.50$10.00 → $15.00$1.28
Grok 4.3200K$1.25 → $2.50$2.50 → $5.00$1.26
Grok 4.20 Multi Agent200K$1.25 → $2.50$2.50 → $5.00$1.26
Grok 4.20 Non Reasoning200K$1.25 → $2.50$2.50 → $5.00$1.26
Grok 4.20 Reasoning200K$1.25 → $2.50$2.50 → $5.00$1.26
GPT-6.1 Sol272K$2.00 → $4.00$10.00 → $15.00$2.03
GPT-6 Sol272K$2.00 → $4.00$10.00 → $15.00$2.03
Grok 4.7200K$2.00 → $4.00$6.00 → $12.00$2.02
Grok 4.6200K$2.00 → $4.00$6.00 → $12.00$2.02
GPT-5.6 Terra272K$2.00 → $4.00$12.00 → $18.00$2.04
Grok 4.5200K$2.00 → $4.00$6.00 → $12.00$2.02
Gemini 3.1 Pro Preview200K$2.00 → $4.00$12.00 → $18.00$2.04
Gemini Pro (latest)200K$2.00 → $4.00$12.00 → $18.00$2.04
GPT-5.4272K$2.50 → $5.00$15.00 → $22.50$2.54
Claude Sonnet 4.5200K$3.00 → $6.00$15.00 → $22.50$3.04
GPT-5.6 Sol272K$4.00 → $8.00$20.00 → $30.00$4.06
GPT-5.5272K$5.00 → $10.00$30.00 → $45.00$5.09
GPT-6 Astra272K$10.00 → $20.00$50.00 → $75.00$10.15
GPT-5.5 Pro272K$30.00 → $60.00$180.00 → $270.00$30.54
GPT-5.4 Pro272K$30.00 → $60.00$180.00 → $270.00$30.54

Los modelos que no aparecen no tienen tramo de contexto largo publicado en nuestros datos o cobran igual a cualquier longitud.

Preguntas frecuentes

¿Se cobra toda la solicitud a la tarifa alta?

En la mayoría de proveedores sí: si el prompt supera el umbral, todos los tokens de entrada y salida de esa solicitud usan el precio de contexto largo, no solo los que exceden.

¿Cómo evito el recargo?

Mantén los prompts bajo el umbral con recuperación (envía solo los fragmentos relevantes), resume turnos antiguos o usa prompt caching para la parte repetida.