Qwen3.8 Max Prime vs Qwen3 VL 8B Thinking

Elige hasta 3 modelos · precio, contexto y capacidades · simula el costo de tu producto

Datos actualizados el 30 de setiembre de 2026· 217 modelos

QwenMax Prime

Qwen3.8 Max Prime is a higher-throughput variant of Qwen3.8 Max from Alibaba's Qwen team, served as a separate SKU at a higher price point.

Ver ficha →

Razonamiento estimado
Velocidad estimado
Entrada
Salida
Contexto
▲1 M tokens
Salida máxima
▲131 K
Entrada, $ por 1M tokens
$4.00
Salida, $ por 1M tokens
$12.00
Lectura de caché, $ por 1M
$0.500
Batch (entrada / salida)
—
Herramientas
Sí
Lanzamiento
▲23/09/2026
Conocimiento hasta
—
Id en la API
qwen/qwen3.8-max-prime
Qwen8B Thinking

Qwen3-VL-8B-Thinking is the reasoning-optimized variant of the Qwen3-VL-8B multimodal model, designed for advanced visual and textual reasoning across complex scenes, documents, and temporal sequences.

Ver ficha →

Razonamiento estimado
▲
Velocidad estimado
▲
Entrada
Salida
Contexto
131 K tokens
Salida máxima
33 K
Entrada, $ por 1M tokens
▲$0.180
Salida, $ por 1M tokens
▲$2.10
Lectura de caché, $ por 1M
—
Batch (entrada / salida)
—
Herramientas
Sí
Lanzamiento
14/10/2025
Conocimiento hasta
—
Id en la API
qwen/qwen3-vl-8b-thinking
Tercer modelo (opcional)
texto imagen audio video PDF / archivo razonamiento (1 a 5, estimado por familia) velocidad (1 a 4, estimada por familia)▲ mejor valor entre los elegidos

¿Cuál conviene más por API: Qwen3.8 Max Prime vs Qwen3 VL 8B Thinking?

  • Qwen3 VL 8B Thinking: entrada más barata (96 % menos que Qwen3.8 Max Prime)
  • Qwen3 VL 8B Thinking: salida más barata
  • Qwen3.8 Max Prime: mayor contexto (1 M)
  • Qwen3.8 Max Prime: el más reciente (23/09/2026)
  • Qwen3 VL 8B Thinking: más razonamiento (estimado)
  • Qwen3 VL 8B Thinking: el más rápido (estimado)

Qwen3 VL 8B Thinking cuesta 96 % menos en entrada y 83 % menos en salida que Qwen3.8 Max Prime ($0.180 / $2.10 frente a $4.00 / $12.00 por millón de tokens). Qwen3.8 Max Prime acepta más contexto (1 M).

¿Cuánto te costaría tu producto?

Estima el costo mensual con el volumen real de tu app. Precios de lista, sin caché ni batch.

Qwen3.8 Max Prime
$108.00/mes
Qwen3 VL 8B Thinking
$11.10/mes

Con Qwen3 VL 8B Thinking ahorras $96.90 al mes frente a Qwen3.8 Max Prime (90 % menos).

Los 6 más baratos para este escenario (chat, últimos 12 meses)

  1. 1Lyria 3 Pro Preview Google$0.00
  2. 2Lyria 3 Clip Preview Google$0.00
  3. 3Qwen3.7 Flash Qwen$0.97
  4. 4DeepSeek V4 Flash 0731 DeepSeek$1.55
  5. 5Ministral 3 3B 2512 Mistral$1.90
  6. 6Qwen3.5-Flash Qwen$2.02

Pega tu prompt: tokens y costo por modelo

Estimación aproximada (unos 3,8 caracteres por token en español). Nada se envía a ningún servidor.

92tokens aprox.348 caracteres

Costo de enviarlo 1 000 veces (solo entrada)

  1. 1Qwen3 VL 8B Thinking Qwen$0.017
  2. 2Claude Sonnet 5.5 Anthropic$0.184
  3. 3Claude Sonnet 5 Anthropic$0.184
  4. 4Qwen3.8 Max Prime Qwen$0.368
  5. 5Claude Opus 5.5 Anthropic$0.368
  6. 6Claude Opus 5 Anthropic$0.460
  7. 7Claude Fable 5.1 Anthropic$0.920
  8. 8Claude Fable 5 Anthropic$0.920

Comparativas frecuentes

Preguntas frecuentes

¿Cuál conviene más por API: Qwen3.8 Max Prime vs Qwen3 VL 8B Thinking?

Qwen3 VL 8B Thinking cuesta 96 % menos en entrada y 83 % menos en salida que Qwen3.8 Max Prime ($0.180 / $2.10 frente a $4.00 / $12.00 por millón de tokens). Qwen3.8 Max Prime acepta más contexto (1 M).

¿Cuál es más barato: Qwen3.8 Max Prime y Qwen3 VL 8B Thinking?

Qwen3 VL 8B Thinking es más barato: $0.180 por millón de tokens de entrada y $2.10 de salida, frente a $4.00 / $12.00 de Qwen3.8 Max Prime.

¿Cuál tiene más contexto: Qwen3.8 Max Prime y Qwen3 VL 8B Thinking?

Qwen3.8 Max Prime acepta 1 M tokens de contexto; Qwen3 VL 8B Thinking acepta 131 K.

¿Cuál es más reciente: Qwen3.8 Max Prime y Qwen3 VL 8B Thinking?

Qwen3.8 Max Prime salió el 23/09/2026; Qwen3 VL 8B Thinking, el 14/10/2025.

¿Cuánto costarían 10 000 peticiones al mes con Qwen3.8 Max Prime y Qwen3 VL 8B Thinking?

Con 1 500 tokens de entrada y 400 de salida por petición: Qwen3.8 Max Prime: $108.00; Qwen3 VL 8B Thinking: $11.10 al mes, a precio de lista.

¿De dónde salen los precios y cada cuánto se actualizan?

De los catálogos públicos de OpenRouter, models.dev y LiteLLM, que publican los precios de lista de cada proveedor. Se sincronizan una vez al día y la fecha de la última actualización aparece arriba de la comparativa.

¿Qué significa el precio por millón de tokens?

Es lo que cobra el proveedor por cada millón de tokens que envías (entrada) o que el modelo genera (salida). Un token equivale a unos 3 o 4 caracteres en español. La salida casi siempre cuesta más que la entrada.

Fuentes: OpenRouter, models.dev y LiteLLM. Precios en USD por millón de tokens, de lista, sin descuentos por volumen. Las descripciones vienen del catálogo en inglés. Los tokens del prompt son una estimación; el tokenizador de cada proveedor puede variar.