Precio de la API de Qwen3.8 Flash
Modelo de Alibaba (Qwen) · contexto de 991,808 tokens · salida máx. 131,072 · visión, razonamiento. Datos modificados por última vez el 2026-10-08. Precio oficial ↗ · Datos sincronizados de la lista de precios de LiteLLM el 2026-10-08.
| Entrada | $0.15 / 1M tokens |
|---|---|
| Salida | $0.47 / 1M tokens |
| Entrada en caché | $0.016 / 1M tokens |
| Escritura en caché | $0.20 / 1M tokens |
Cuánto cuesta al mes
| Escenario (al mes) | Qwen3.8 Flash |
|---|---|
| Chatbot de atención al cliente 5,000 sol./día · 1,200 entrada · 400 salida · caché 60% | $41.18 |
| RAG sobre documentos 2,000 sol./día · 8,000 entrada · 600 salida · caché 30% | $70.82 |
| Agente de código 1,500 sol./día · 25,000 entrada · 2,000 salida · caché 80% | $96.08 |
| Razonamiento profundo 800 sol./día · 3,000 entrada · 6,000 salida · caché 20% | $76.55 |
| Procesamiento por lotes 50,000 sol./día · 1,500 entrada · 150 salida · batch | $443 |
Ajusta las cifras en la calculadora.
Alternativas más baratas
Menor coste mensual en el escenario chatbot entre modelos de razonamiento:
- Qwen Turbo — $21.00/mes
- MiMo V2.6 Flash — $27.18/mes
- GPT-5 nano — $28.14/mes
- Gemini 2.5 Flash Lite — $32.28/mes
- Qwen Flash — $33.00/mes
Comparativas
Historial de precios
- 2026-10-08: Añadido — → —