DeepSeek V4.1 Flash vs Qwen2.5 VL 72B Instruct
Elige hasta 3 modelos · precio, contexto y capacidades · simula el costo de tu producto
Datos actualizados el 30 de setiembre de 2026· 217 modelos
DeepSeek V4.1 Flash is a sparse mixture-of-experts model from DeepSeek, and the first built on the company's Causal Encoder-Decoder (CED) architecture.
- Razonamiento estimado
- Velocidad estimado
- ▲
- Entrada
- Salida
- Contexto
- ▲1 M tokens
- Salida máxima
- ▲944 K
- Entrada, $ por 1M tokens
- ▲$0.300
- Salida, $ por 1M tokens
- $1.20
- Lectura de caché, $ por 1M
- $0.006
- Batch (entrada / salida)
- $0.112 / $0.336
- Herramientas
- Sí
- Lanzamiento
- ▲10/09/2026
- Conocimiento hasta
- 2025-05
- Id en la API
- deepseek/deepseek-v4.1-flash
Qwen2.5-VL is proficient in recognizing common objects such as flowers, birds, fish, and insects.
- Razonamiento estimado
- ▲
- Velocidad estimado
- Entrada
- Salida
- Contexto
- 128 K tokens
- Salida máxima
- 115 K
- Entrada, $ por 1M tokens
- $0.800
- Salida, $ por 1M tokens
- ▲$1.00
- Lectura de caché, $ por 1M
- $0.400
- Batch (entrada / salida)
- —
- Herramientas
- No
- Lanzamiento
- 27/01/2025
- Conocimiento hasta
- —
- Id en la API
- qwen/qwen2.5-vl-72b-instruct
¿Cuál conviene más por API: DeepSeek V4.1 Flash vs Qwen2.5 VL 72B Instruct?
- DeepSeek V4.1 Flash: entrada más barata (63 % menos que Qwen2.5 VL 72B Instruct)
- Qwen2.5 VL 72B Instruct: salida más barata
- DeepSeek V4.1 Flash: mayor contexto (1 M)
- DeepSeek V4.1 Flash: el más reciente (10/09/2026)
- Qwen2.5 VL 72B Instruct: más razonamiento (estimado)
- DeepSeek V4.1 Flash: el más rápido (estimado)
En precio están repartidos: DeepSeek V4.1 Flash gana en entrada y Qwen2.5 VL 72B Instruct gana en salida. DeepSeek V4.1 Flash acepta más contexto (1 M). DeepSeek V4.1 Flash ofrece tarifa batch a mitad de precio para trabajos que no necesitan respuesta inmediata.
¿Cuánto te costaría tu producto?
Estima el costo mensual con el volumen real de tu app. Precios de lista, sin caché ni batch.
Con DeepSeek V4.1 Flash ahorras $6.70 al mes frente a Qwen2.5 VL 72B Instruct (42 % menos).
Los 6 más baratos para este escenario (chat, últimos 12 meses)
- 1Lyria 3 Pro Preview Google$0.00
- 2Lyria 3 Clip Preview Google$0.00
- 3Qwen3.7 Flash Qwen$0.97
- 4DeepSeek V4 Flash 0731 DeepSeek$1.55
- 5Ministral 3 3B 2512 Mistral$1.90
- 6Qwen3.5-Flash Qwen$2.02
Pega tu prompt: tokens y costo por modelo
Estimación aproximada (unos 3,8 caracteres por token en español). Nada se envía a ningún servidor.
Costo de enviarlo 1 000 veces (solo entrada)
- 1DeepSeek V4.1 Flash DeepSeek$0.028
- 2Qwen2.5 VL 72B Instruct Qwen$0.074
- 3Claude Sonnet 5.5 Anthropic$0.184
- 4Claude Sonnet 5 Anthropic$0.184
- 5Claude Opus 5.5 Anthropic$0.368
- 6Claude Opus 5 Anthropic$0.460
- 7Claude Fable 5.1 Anthropic$0.920
- 8Claude Fable 5 Anthropic$0.920
Comparativas frecuentes
- Claude Sonnet 5.5 vs GPT-6.1 Sol
- Claude Sonnet 5.5 vs Gemini 3.8 Flash
- Claude Sonnet 5.5 vs DeepSeek V4.1 Flash
- Claude Sonnet 5.5 vs Grok 4.7
- GPT-6.1 Sol vs Gemini 3.8 Flash
- GPT-6.1 Sol vs DeepSeek V4.1 Flash
- GPT-6.1 Sol vs Grok 4.7
- Gemini 3.8 Flash vs DeepSeek V4.1 Flash
- Gemini 3.8 Flash vs Grok 4.7
- DeepSeek V4.1 Flash vs Grok 4.7
Preguntas frecuentes
¿Cuál conviene más por API: DeepSeek V4.1 Flash vs Qwen2.5 VL 72B Instruct?
En precio están repartidos: DeepSeek V4.1 Flash gana en entrada y Qwen2.5 VL 72B Instruct gana en salida. DeepSeek V4.1 Flash acepta más contexto (1 M). DeepSeek V4.1 Flash ofrece tarifa batch a mitad de precio para trabajos que no necesitan respuesta inmediata.
¿Cuál es más barato: DeepSeek V4.1 Flash y Qwen2.5 VL 72B Instruct?
DeepSeek V4.1 Flash es más barato: $0.300 por millón de tokens de entrada y $1.20 de salida, frente a $0.800 / $1.00 de Qwen2.5 VL 72B Instruct.
¿Cuál tiene más contexto: DeepSeek V4.1 Flash y Qwen2.5 VL 72B Instruct?
DeepSeek V4.1 Flash acepta 1 M tokens de contexto; Qwen2.5 VL 72B Instruct acepta 128 K.
¿Cuál es más reciente: DeepSeek V4.1 Flash y Qwen2.5 VL 72B Instruct?
DeepSeek V4.1 Flash salió el 10/09/2026; Qwen2.5 VL 72B Instruct, el 27/01/2025.
¿Cuánto costarían 10 000 peticiones al mes con DeepSeek V4.1 Flash y Qwen2.5 VL 72B Instruct?
Con 1 500 tokens de entrada y 400 de salida por petición: DeepSeek V4.1 Flash: $9.30; Qwen2.5 VL 72B Instruct: $16.00 al mes, a precio de lista.
¿De dónde salen los precios y cada cuánto se actualizan?
De los catálogos públicos de OpenRouter, models.dev y LiteLLM, que publican los precios de lista de cada proveedor. Se sincronizan una vez al día y la fecha de la última actualización aparece arriba de la comparativa.
¿Qué significa el precio por millón de tokens?
Es lo que cobra el proveedor por cada millón de tokens que envías (entrada) o que el modelo genera (salida). Un token equivale a unos 3 o 4 caracteres en español. La salida casi siempre cuesta más que la entrada.
Fuentes: OpenRouter, models.dev y LiteLLM. Precios en USD por millón de tokens, de lista, sin descuentos por volumen. Las descripciones vienen del catálogo en inglés. Los tokens del prompt son una estimación; el tokenizador de cada proveedor puede variar.