Llama 3.3 70B Instruct
Elige hasta 3 modelos · precio, contexto y capacidades · simula el costo de tu producto
Datos actualizados el 30 de setiembre de 2026· 217 modelos
The Meta Llama 3.3 multilingual large language model (LLM) is a pretrained and instruction tuned generative model in 70B (text in/text out).
- Razonamiento estimado
- Velocidad estimado
- Entrada
- Salida
- Contexto
- 131 K tokens
- Salida máxima
- 16 K
- Entrada, $ por 1M tokens
- $0.100
- Salida, $ por 1M tokens
- $0.320
- Lectura de caché, $ por 1M
- —
- Batch (entrada / salida)
- —
- Herramientas
- Sí
- Lanzamiento
- 06/12/2024
- Conocimiento hasta
- 2023-12
- Id en la API
- meta-llama/llama-3.3-70b-instruct
Resumen desde los datos
Llama 3.3 70B Instruct es un modelo de Meta disponible por API desde el 06/12/2024. Cuesta $0.100 por millón de tokens de entrada y $0.320 de salida, acepta 131 K tokens de contexto y genera hasta 16 K tokens por respuesta. Entrada: texto; salida: texto. No tiene modo de razonamiento. Soporta llamadas a herramientas. Con 10 000 peticiones al mes de 1 500 tokens de entrada y 400 de salida costaría unos $2.78 al mes.
Compara Llama 3.3 70B Instruct con…
- Llama 3.3 70B Instruct vs Claude Sonnet 5.5
- Llama 3.3 70B Instruct vs DeepSeek V4.1 Flash
- Llama 3.3 70B Instruct vs Gemini 3.8 Flash
- Llama 3.3 70B Instruct vs Mistral Medium 3.5
- Llama 3.3 70B Instruct vs Kimi K3
- Llama 3.3 70B Instruct vs GPT-6.1 Sol
- Llama 3.3 70B Instruct vs Qwen3.8 Max Prime
- Llama 3.3 70B Instruct vs Grok 4.7
¿Cuánto te costaría tu producto?
Estima el costo mensual con el volumen real de tu app. Precios de lista, sin caché ni batch.
Los 6 más baratos para este escenario (chat, últimos 12 meses)
- 1Lyria 3 Pro Preview Google$0.00
- 2Lyria 3 Clip Preview Google$0.00
- 3Qwen3.7 Flash Qwen$0.97
- 4DeepSeek V4 Flash 0731 DeepSeek$1.55
- 5Ministral 3 3B 2512 Mistral$1.90
- 6Qwen3.5-Flash Qwen$2.02
Preguntas frecuentes
¿Cuánto cuesta Llama 3.3 70B Instruct por millón de tokens?
Llama 3.3 70B Instruct cuesta $0.100 por millón de tokens de entrada y $0.320 por millón de salida (USD, precio de lista). Lectura de caché: no publicado. Tarifa batch: no publicado.
¿Qué ventana de contexto tiene Llama 3.3 70B Instruct?
Llama 3.3 70B Instruct acepta 131 K tokens de contexto por petición y genera hasta 16 K tokens por respuesta.
¿Llama 3.3 70B Instruct acepta imágenes, audio o archivos?
Entrada: texto. Salida: texto.
¿Llama 3.3 70B Instruct tiene modo de razonamiento y llamadas a herramientas?
No tiene modo de razonamiento. Soporta llamadas a herramientas.
¿Cuándo salió Llama 3.3 70B Instruct y hasta cuándo llega su conocimiento?
Llama 3.3 70B Instruct está disponible por API desde el 06/12/2024. Corte de conocimiento: 2023-12.
¿Cuánto costaría una app con Llama 3.3 70B Instruct?
Con 10 000 peticiones al mes de 1 500 tokens de entrada y 400 de salida, Llama 3.3 70B Instruct costaría unos $2.78 al mes a precio de lista, sin caché ni batch.
¿Cuál es el id de Llama 3.3 70B Instruct en la API?
El id es meta-llama/llama-3.3-70b-instruct. Es el nombre que se pasa en el parámetro model de la API (o en OpenRouter).
¿De dónde salen los precios y cada cuánto se actualizan?
De los catálogos públicos de OpenRouter, models.dev y LiteLLM, que publican los precios de lista de cada proveedor. Se sincronizan una vez al día y la fecha de la última actualización aparece arriba de la comparativa.
¿Qué significa el precio por millón de tokens?
Es lo que cobra el proveedor por cada millón de tokens que envías (entrada) o que el modelo genera (salida). Un token equivale a unos 3 o 4 caracteres en español. La salida casi siempre cuesta más que la entrada.
Fuentes: OpenRouter, models.dev y LiteLLM. Precios en USD por millón de tokens, de lista, sin descuentos por volumen. Las descripciones vienen del catálogo en inglés. Los tokens del prompt son una estimación; el tokenizador de cada proveedor puede variar.