Gemma 3 12B vs Gemma 4 26B A4B

Elige hasta 3 modelos · precio, contexto y capacidades · simula el costo de tu producto

Datos actualizados el 30 de setiembre de 2026· 217 modelos

Google3 12B

Gemma 3 introduces multimodality, supporting vision-language input and text outputs.

Ver ficha →

Razonamiento estimado
Velocidad estimado
▲
Entrada
Salida
Contexto
131 K tokens
Salida máxima
16 K
Entrada, $ por 1M tokens
▲$0.050
Salida, $ por 1M tokens
▲$0.150
Lectura de caché, $ por 1M
—
Batch (entrada / salida)
—
Herramientas
No
Lanzamiento
01/12/2024
Conocimiento hasta
2024-12
Id en la API
google/gemma-3-12b-it
Google26B A4B

Gemma 4 26B A4B IT is an instruction-tuned Mixture-of-Experts (MoE) model from Google DeepMind.

Ver ficha →

Razonamiento estimado
▲
Velocidad estimado
Entrada
Salida
Contexto
▲262 K tokens
Salida máxima
▲236 K
Entrada, $ por 1M tokens
$0.077
Salida, $ por 1M tokens
$0.255
Lectura de caché, $ por 1M
$0.043
Batch (entrada / salida)
—
Herramientas
Sí
Lanzamiento
▲02/04/2026
Conocimiento hasta
—
Id en la API
google/gemma-4-26b-a4b-it
Tercer modelo (opcional)
texto imagen audio video PDF / archivo razonamiento (1 a 5, estimado por familia) velocidad (1 a 4, estimada por familia)▲ mejor valor entre los elegidos

¿Cuál conviene más por API: Gemma 3 12B vs Gemma 4 26B A4B ?

  • Gemma 3 12B: entrada más barata (35 % menos que Gemma 4 26B A4B )
  • Gemma 3 12B: salida más barata
  • Gemma 4 26B A4B : mayor contexto (262 K)
  • Gemma 4 26B A4B : el más reciente (02/04/2026)
  • Gemma 4 26B A4B : más razonamiento (estimado)
  • Gemma 3 12B: el más rápido (estimado)

Gemma 3 12B cuesta 35 % menos en entrada y 41 % menos en salida que Gemma 4 26B A4B ($0.050 / $0.150 frente a $0.077 / $0.255 por millón de tokens). Gemma 4 26B A4B acepta más contexto (262 K). En capacidades, Gemma 4 26B A4B tiene modo de razonamiento.

¿Cuánto te costaría tu producto?

Estima el costo mensual con el volumen real de tu app. Precios de lista, sin caché ni batch.

Gemma 3 12B
$1.35/mes
Gemma 4 26B A4B
$2.17/mes

Con Gemma 3 12B ahorras $0.82 al mes frente a Gemma 4 26B A4B (38 % menos).

Los 6 más baratos para este escenario (chat, últimos 12 meses)

  1. 1Lyria 3 Pro Preview Google$0.00
  2. 2Lyria 3 Clip Preview Google$0.00
  3. 3Qwen3.7 Flash Qwen$0.97
  4. 4DeepSeek V4 Flash 0731 DeepSeek$1.55
  5. 5Ministral 3 3B 2512 Mistral$1.90
  6. 6Qwen3.5-Flash Qwen$2.02

Pega tu prompt: tokens y costo por modelo

Estimación aproximada (unos 3,8 caracteres por token en español). Nada se envía a ningún servidor.

92tokens aprox.348 caracteres

Costo de enviarlo 1 000 veces (solo entrada)

  1. 1Gemma 3 12B Google$0.005
  2. 2Gemma 4 26B A4B Google$0.007
  3. 3Claude Sonnet 5.5 Anthropic$0.184
  4. 4Claude Sonnet 5 Anthropic$0.184
  5. 5Claude Opus 5.5 Anthropic$0.368
  6. 6Claude Opus 5 Anthropic$0.460
  7. 7Claude Fable 5.1 Anthropic$0.920
  8. 8Claude Fable 5 Anthropic$0.920

Comparativas frecuentes

Preguntas frecuentes

¿Cuál conviene más por API: Gemma 3 12B vs Gemma 4 26B A4B ?

Gemma 3 12B cuesta 35 % menos en entrada y 41 % menos en salida que Gemma 4 26B A4B ($0.050 / $0.150 frente a $0.077 / $0.255 por millón de tokens). Gemma 4 26B A4B acepta más contexto (262 K). En capacidades, Gemma 4 26B A4B tiene modo de razonamiento.

¿Cuál es más barato: Gemma 3 12B y Gemma 4 26B A4B ?

Gemma 3 12B es más barato: $0.050 por millón de tokens de entrada y $0.150 de salida, frente a $0.077 / $0.255 de Gemma 4 26B A4B .

¿Cuál tiene más contexto: Gemma 3 12B y Gemma 4 26B A4B ?

Gemma 4 26B A4B acepta 262 K tokens de contexto; Gemma 3 12B acepta 131 K.

¿Cuál es más reciente: Gemma 3 12B y Gemma 4 26B A4B ?

Gemma 4 26B A4B salió el 02/04/2026; Gemma 3 12B, el 01/12/2024.

¿Cuánto costarían 10 000 peticiones al mes con Gemma 3 12B y Gemma 4 26B A4B ?

Con 1 500 tokens de entrada y 400 de salida por petición: Gemma 3 12B: $1.35; Gemma 4 26B A4B : $2.17 al mes, a precio de lista.

¿De dónde salen los precios y cada cuánto se actualizan?

De los catálogos públicos de OpenRouter, models.dev y LiteLLM, que publican los precios de lista de cada proveedor. Se sincronizan una vez al día y la fecha de la última actualización aparece arriba de la comparativa.

¿Qué significa el precio por millón de tokens?

Es lo que cobra el proveedor por cada millón de tokens que envías (entrada) o que el modelo genera (salida). Un token equivale a unos 3 o 4 caracteres en español. La salida casi siempre cuesta más que la entrada.

Fuentes: OpenRouter, models.dev y LiteLLM. Precios en USD por millón de tokens, de lista, sin descuentos por volumen. Las descripciones vienen del catálogo en inglés. Los tokens del prompt son una estimación; el tokenizador de cada proveedor puede variar.