Modelos de IA más baratos por API
Elige hasta 3 modelos · precio, contexto y capacidades · simula el costo de tu producto
Datos actualizados el 30 de setiembre de 2026· 217 modelos
Los 25 modelos de chat más baratos por API, ordenados por precio de entrada por millón de tokens (y salida en caso de empate). Solo modelos lanzados en los últimos 12 meses. Datos del 30/09/2026.
| # | Modelo | Proveedor | Entrada $/1M | Salida $/1M | Contexto | Capacidades | Lanzamiento |
|---|---|---|---|---|---|---|---|
| 1 | Lyria 3 Pro Preview | $0.000 | $0.000 | 1 M | 25/03/2026 | ||
| 2 | Lyria 3 Clip Preview | $0.000 | $0.000 | 1 M | 25/03/2026 | ||
| 3 | DeepSeek V4 Flash 0731 | DeepSeek | $0.018 | $0.320 | 1 M | 31/07/2026 | |
| 4 | Qwen3.7 Flash | Qwen | $0.030 | $0.130 | 1 M | 15/07/2026 | |
| 5 | Qwen3.5-Flash | Qwen | $0.065 | $0.260 | 1 M | 25/02/2026 | |
| 6 | gpt-oss-safeguard-20b | OpenAI | $0.075 | $0.300 | 131 K | 29/10/2025 | |
| 7 | Gemma 4 26B A4B | $0.077 | $0.255 | 262 K | 02/04/2026 | ||
| 8 | Gemma 4 31B | $0.090 | $0.340 | 262 K | 02/04/2026 | ||
| 9 | Ministral 3 3B 2512 | Mistral | $0.100 | $0.100 | 131 K | 03/12/2025 | |
| 10 | Qwen3.5-9B | Qwen | $0.100 | $0.150 | 262 K | 23/02/2026 | |
| 11 | GPT-6 Luna | OpenAI | $0.100 | $0.500 | 1.1 M | 22/09/2026 | |
| 12 | GPT-6 Luna Pro | OpenAI | $0.100 | $0.500 | 1.1 M | 22/09/2026 | |
| 13 | Qwen3 VL 32B Instruct | Qwen | $0.104 | $0.416 | 131 K | 23/10/2025 | |
| 14 | Qwen3 VL 8B Instruct | Qwen | $0.117 | $0.455 | 262 K | 14/10/2025 | |
| 15 | Qwen3 Coder Next | Qwen | $0.120 | $0.800 | 262 K | 03/02/2026 | |
| 16 | DeepSeek V4 Flash 0423 | DeepSeek | $0.140 | $0.280 | 1 M | 24/04/2026 | |
| 17 | Ministral 3 8B 2512 | Mistral | $0.150 | $0.150 | 262 K | 03/12/2025 | |
| 18 | Qwen3.8 Omni Flash | Qwen | $0.150 | $0.470 | 1 M | 17/09/2026 | |
| 19 | Qwen3.8 Flash | Qwen | $0.150 | $0.470 | 1 M | 26/08/2026 | |
| 20 | Mistral Small 4 | Mistral | $0.150 | $0.600 | 262 K | 16/03/2026 | |
| 21 | Qwen3 VL 30B A3B Instruct | Qwen | $0.150 | $0.600 | 262 K | 02/10/2025 | |
| 22 | Qwen3.6 35B A3B | Qwen | $0.150 | $1.00 | 262 K | 17/04/2026 | |
| 23 | Qwen3.5-35B-A3B | Qwen | $0.163 | $1.30 | 262 K | 23/02/2026 | |
| 24 | Qwen3 VL 8B Thinking | Qwen | $0.180 | $2.10 | 131 K | 14/10/2025 | |
| 25 | Qwen3.6 Flash | Qwen | $0.188 | $1.13 | 1 M | 27/04/2026 |
Preguntas frecuentes
¿Cuál es el modelo de IA más barato por API?
Lyria 3 Pro Preview, de Google: $0.000 por millón de tokens de entrada y $0.000 de salida, según datos del 30/09/2026.
¿Cómo se ordena esta lista?
Por precio de entrada por millón de tokens, de menor a mayor; en empate, por precio de salida. Solo modelos de chat lanzados en los últimos 12 meses (25 en total).
¿De dónde salen los precios y cada cuánto se actualizan?
De los catálogos públicos de OpenRouter, models.dev y LiteLLM, que publican los precios de lista de cada proveedor. Se sincronizan una vez al día y la fecha de la última actualización aparece arriba de la comparativa.
¿Qué significa el precio por millón de tokens?
Es lo que cobra el proveedor por cada millón de tokens que envías (entrada) o que el modelo genera (salida). Un token equivale a unos 3 o 4 caracteres en español. La salida casi siempre cuesta más que la entrada.
Fuentes: OpenRouter, models.dev y LiteLLM. Precios en USD por millón de tokens, de lista, sin descuentos por volumen. Las descripciones vienen del catálogo en inglés. Los tokens del prompt son una estimación; el tokenizador de cada proveedor puede variar.