Qwen3 VL 8B Thinking
Elige hasta 3 modelos · precio, contexto y capacidades · simula el costo de tu producto
Datos actualizados el 30 de setiembre de 2026· 217 modelos
Qwen3-VL-8B-Thinking is the reasoning-optimized variant of the Qwen3-VL-8B multimodal model, designed for advanced visual and textual reasoning across complex scenes, documents, and temporal sequences.
- Razonamiento estimado
- Velocidad estimado
- Entrada
- Salida
- Contexto
- 131 K tokens
- Salida máxima
- 33 K
- Entrada, $ por 1M tokens
- $0.180
- Salida, $ por 1M tokens
- $2.10
- Lectura de caché, $ por 1M
- —
- Batch (entrada / salida)
- —
- Herramientas
- Sí
- Lanzamiento
- 14/10/2025
- Conocimiento hasta
- —
- Id en la API
- qwen/qwen3-vl-8b-thinking
Resumen desde los datos
Qwen3 VL 8B Thinking es un modelo de Qwen disponible por API desde el 14/10/2025. Cuesta $0.180 por millón de tokens de entrada y $2.10 de salida, acepta 131 K tokens de contexto y genera hasta 33 K tokens por respuesta. Entrada: imagen, texto; salida: texto. Tiene modo de razonamiento. Soporta llamadas a herramientas. Con 10 000 peticiones al mes de 1 500 tokens de entrada y 400 de salida costaría unos $11.10 al mes.
Compara Qwen3 VL 8B Thinking con…
- Qwen3 VL 8B Thinking vs Qwen3.8 Max Prime
- Qwen3 VL 8B Thinking vs Qwen3.8 Omni Flash
- Qwen3 VL 8B Thinking vs Qwen3.8 Max (0902)
- Qwen3 VL 8B Thinking vs Qwen3.8 Flash
- Qwen3 VL 8B Thinking vs Claude Sonnet 5.5
- Qwen3 VL 8B Thinking vs DeepSeek V4.1 Flash
- Qwen3 VL 8B Thinking vs Gemini 3.8 Flash
- Qwen3 VL 8B Thinking vs Mistral Medium 3.5
- Qwen3 VL 8B Thinking vs Kimi K3
- Qwen3 VL 8B Thinking vs GPT-6.1 Sol
¿Cuánto te costaría tu producto?
Estima el costo mensual con el volumen real de tu app. Precios de lista, sin caché ni batch.
Los 6 más baratos para este escenario (chat, últimos 12 meses)
- 1Lyria 3 Pro Preview Google$0.00
- 2Lyria 3 Clip Preview Google$0.00
- 3Qwen3.7 Flash Qwen$0.97
- 4DeepSeek V4 Flash 0731 DeepSeek$1.55
- 5Ministral 3 3B 2512 Mistral$1.90
- 6Qwen3.5-Flash Qwen$2.02
Preguntas frecuentes
¿Cuánto cuesta Qwen3 VL 8B Thinking por millón de tokens?
Qwen3 VL 8B Thinking cuesta $0.180 por millón de tokens de entrada y $2.10 por millón de salida (USD, precio de lista). Lectura de caché: no publicado. Tarifa batch: no publicado.
¿Qué ventana de contexto tiene Qwen3 VL 8B Thinking?
Qwen3 VL 8B Thinking acepta 131 K tokens de contexto por petición y genera hasta 33 K tokens por respuesta.
¿Qwen3 VL 8B Thinking acepta imágenes, audio o archivos?
Entrada: imagen, texto. Salida: texto.
¿Qwen3 VL 8B Thinking tiene modo de razonamiento y llamadas a herramientas?
Tiene modo de razonamiento. Soporta llamadas a herramientas.
¿Cuándo salió Qwen3 VL 8B Thinking y hasta cuándo llega su conocimiento?
Qwen3 VL 8B Thinking está disponible por API desde el 14/10/2025. Corte de conocimiento: no publicado.
¿Cuánto costaría una app con Qwen3 VL 8B Thinking?
Con 10 000 peticiones al mes de 1 500 tokens de entrada y 400 de salida, Qwen3 VL 8B Thinking costaría unos $11.10 al mes a precio de lista, sin caché ni batch.
¿Cuál es el id de Qwen3 VL 8B Thinking en la API?
El id es qwen/qwen3-vl-8b-thinking. Es el nombre que se pasa en el parámetro model de la API (o en OpenRouter).
¿De dónde salen los precios y cada cuánto se actualizan?
De los catálogos públicos de OpenRouter, models.dev y LiteLLM, que publican los precios de lista de cada proveedor. Se sincronizan una vez al día y la fecha de la última actualización aparece arriba de la comparativa.
¿Qué significa el precio por millón de tokens?
Es lo que cobra el proveedor por cada millón de tokens que envías (entrada) o que el modelo genera (salida). Un token equivale a unos 3 o 4 caracteres en español. La salida casi siempre cuesta más que la entrada.
Fuentes: OpenRouter, models.dev y LiteLLM. Precios en USD por millón de tokens, de lista, sin descuentos por volumen. Las descripciones vienen del catálogo en inglés. Los tokens del prompt son una estimación; el tokenizador de cada proveedor puede variar.