Qwen3.5 397B A17B vs Qwen3.5-Flash

Elige hasta 3 modelos · precio, contexto y capacidades · simula el costo de tu producto

Datos actualizados el 30 de setiembre de 2026· 217 modelos

Qwen397B A17B

The Qwen3.5 series 397B-A17B native vision-language model is built on a hybrid architecture that integrates a linear attention mechanism with a sparse mixture-of-experts model, achieving higher inference efficiency.

Ver ficha →

Razonamiento estimado
▲
Velocidad estimado
Entrada
Salida
Contexto
262 K tokens
Salida máxima
▲236 K
Entrada, $ por 1M tokens
$0.550
Salida, $ por 1M tokens
$3.50
Lectura de caché, $ por 1M
$0.225
Batch (entrada / salida)
—
Herramientas
Sí
Lanzamiento
16/02/2026
Conocimiento hasta
2025-04
Id en la API
qwen/qwen3.5-397b-a17b
QwenQwen3.5-Flash

The Qwen3.5 native vision-language Flash models are built on a hybrid architecture that integrates a linear attention mechanism with a sparse mixture-of-experts model, achieving higher inference efficiency.

Ver ficha →

Razonamiento estimado
Velocidad estimado
▲
Entrada
Salida
Contexto
▲1 M tokens
Salida máxima
66 K
Entrada, $ por 1M tokens
▲$0.065
Salida, $ por 1M tokens
▲$0.260
Lectura de caché, $ por 1M
—
Batch (entrada / salida)
—
Herramientas
Sí
Lanzamiento
▲25/02/2026
Conocimiento hasta
—
Id en la API
qwen/qwen3.5-flash-02-23
Tercer modelo (opcional)
texto imagen audio video PDF / archivo razonamiento (1 a 5, estimado por familia) velocidad (1 a 4, estimada por familia)▲ mejor valor entre los elegidos

¿Cuál conviene más por API: Qwen3.5 397B A17B vs Qwen3.5-Flash?

  • Qwen3.5-Flash: entrada más barata (88 % menos que Qwen3.5 397B A17B)
  • Qwen3.5-Flash: salida más barata
  • Qwen3.5-Flash: mayor contexto (1 M)
  • Qwen3.5-Flash: el más reciente (25/02/2026)
  • Qwen3.5 397B A17B: más razonamiento (estimado)
  • Qwen3.5-Flash: el más rápido (estimado)

Qwen3.5-Flash cuesta 88 % menos en entrada y 93 % menos en salida que Qwen3.5 397B A17B ($0.065 / $0.260 frente a $0.550 / $3.50 por millón de tokens). Qwen3.5-Flash acepta más contexto (1 M).

¿Cuánto te costaría tu producto?

Estima el costo mensual con el volumen real de tu app. Precios de lista, sin caché ni batch.

Qwen3.5 397B A17B
$22.25/mes
Qwen3.5-Flash
$2.02/mes

Con Qwen3.5-Flash ahorras $20.24 al mes frente a Qwen3.5 397B A17B (91 % menos).

Los 6 más baratos para este escenario (chat, últimos 12 meses)

  1. 1Lyria 3 Pro Preview Google$0.00
  2. 2Lyria 3 Clip Preview Google$0.00
  3. 3Qwen3.7 Flash Qwen$0.97
  4. 4DeepSeek V4 Flash 0731 DeepSeek$1.55
  5. 5Ministral 3 3B 2512 Mistral$1.90
  6. 6Qwen3.5-Flash Qwen$2.02

Pega tu prompt: tokens y costo por modelo

Estimación aproximada (unos 3,8 caracteres por token en español). Nada se envía a ningún servidor.

92tokens aprox.348 caracteres

Costo de enviarlo 1 000 veces (solo entrada)

  1. 1Qwen3.5-Flash Qwen$0.006
  2. 2Qwen3.5 397B A17B Qwen$0.051
  3. 3Claude Sonnet 5.5 Anthropic$0.184
  4. 4Claude Sonnet 5 Anthropic$0.184
  5. 5Claude Opus 5.5 Anthropic$0.368
  6. 6Claude Opus 5 Anthropic$0.460
  7. 7Claude Fable 5.1 Anthropic$0.920
  8. 8Claude Fable 5 Anthropic$0.920

Comparativas frecuentes

Preguntas frecuentes

¿Cuál conviene más por API: Qwen3.5 397B A17B vs Qwen3.5-Flash?

Qwen3.5-Flash cuesta 88 % menos en entrada y 93 % menos en salida que Qwen3.5 397B A17B ($0.065 / $0.260 frente a $0.550 / $3.50 por millón de tokens). Qwen3.5-Flash acepta más contexto (1 M).

¿Cuál es más barato: Qwen3.5 397B A17B y Qwen3.5-Flash?

Qwen3.5-Flash es más barato: $0.065 por millón de tokens de entrada y $0.260 de salida, frente a $0.550 / $3.50 de Qwen3.5 397B A17B.

¿Cuál tiene más contexto: Qwen3.5 397B A17B y Qwen3.5-Flash?

Qwen3.5-Flash acepta 1 M tokens de contexto; Qwen3.5 397B A17B acepta 262 K.

¿Cuál es más reciente: Qwen3.5 397B A17B y Qwen3.5-Flash?

Qwen3.5-Flash salió el 25/02/2026; Qwen3.5 397B A17B, el 16/02/2026.

¿Cuánto costarían 10 000 peticiones al mes con Qwen3.5 397B A17B y Qwen3.5-Flash?

Con 1 500 tokens de entrada y 400 de salida por petición: Qwen3.5 397B A17B: $22.25; Qwen3.5-Flash: $2.02 al mes, a precio de lista.

¿De dónde salen los precios y cada cuánto se actualizan?

De los catálogos públicos de OpenRouter, models.dev y LiteLLM, que publican los precios de lista de cada proveedor. Se sincronizan una vez al día y la fecha de la última actualización aparece arriba de la comparativa.

¿Qué significa el precio por millón de tokens?

Es lo que cobra el proveedor por cada millón de tokens que envías (entrada) o que el modelo genera (salida). Un token equivale a unos 3 o 4 caracteres en español. La salida casi siempre cuesta más que la entrada.

Fuentes: OpenRouter, models.dev y LiteLLM. Precios en USD por millón de tokens, de lista, sin descuentos por volumen. Las descripciones vienen del catálogo en inglés. Los tokens del prompt son una estimación; el tokenizador de cada proveedor puede variar.