Gemma 3 4B vs Gemma 4 31B

Elige hasta 3 modelos · precio, contexto y capacidades · simula el costo de tu producto

Datos actualizados el 30 de setiembre de 2026· 217 modelos

Google3 4B

Gemma 3 introduces multimodality, supporting vision-language input and text outputs.

Ver ficha →

Razonamiento estimado
Velocidad estimado
Entrada
Salida
Contexto
131 K tokens
Salida máxima
16 K
Entrada, $ por 1M tokens
▲$0.050
Salida, $ por 1M tokens
▲$0.100
Lectura de caché, $ por 1M
—
Batch (entrada / salida)
—
Herramientas
No
Lanzamiento
13/03/2025
Conocimiento hasta
—
Id en la API
google/gemma-3-4b-it
Google4 31B

Gemma 4 31B Instruct is Google DeepMind's 30.7B dense multimodal model supporting text and image input with text output.

Ver ficha →

Razonamiento estimado
▲
Velocidad estimado
Entrada
Salida
Contexto
▲262 K tokens
Salida máxima
16 K
Entrada, $ por 1M tokens
$0.090
Salida, $ por 1M tokens
$0.340
Lectura de caché, $ por 1M
$0.050
Batch (entrada / salida)
—
Herramientas
Sí
Lanzamiento
▲02/04/2026
Conocimiento hasta
—
Id en la API
google/gemma-4-31b-it
Tercer modelo (opcional)
texto imagen audio video PDF / archivo razonamiento (1 a 5, estimado por familia) velocidad (1 a 4, estimada por familia)▲ mejor valor entre los elegidos

¿Cuál conviene más por API: Gemma 3 4B vs Gemma 4 31B?

  • Gemma 3 4B: entrada más barata (44 % menos que Gemma 4 31B)
  • Gemma 3 4B: salida más barata
  • Gemma 4 31B: mayor contexto (262 K)
  • Gemma 4 31B: el más reciente (02/04/2026)
  • Gemma 4 31B: más razonamiento (estimado)

Gemma 3 4B cuesta 44 % menos en entrada y 71 % menos en salida que Gemma 4 31B ($0.050 / $0.100 frente a $0.090 / $0.340 por millón de tokens). Gemma 4 31B acepta más contexto (262 K). En capacidades, Gemma 4 31B tiene modo de razonamiento.

¿Cuánto te costaría tu producto?

Estima el costo mensual con el volumen real de tu app. Precios de lista, sin caché ni batch.

Gemma 3 4B
$1.15/mes
Gemma 4 31B
$2.71/mes

Con Gemma 3 4B ahorras $1.56 al mes frente a Gemma 4 31B (58 % menos).

Los 6 más baratos para este escenario (chat, últimos 12 meses)

  1. 1Lyria 3 Pro Preview Google$0.00
  2. 2Lyria 3 Clip Preview Google$0.00
  3. 3Qwen3.7 Flash Qwen$0.97
  4. 4DeepSeek V4 Flash 0731 DeepSeek$1.55
  5. 5Ministral 3 3B 2512 Mistral$1.90
  6. 6Qwen3.5-Flash Qwen$2.02

Pega tu prompt: tokens y costo por modelo

Estimación aproximada (unos 3,8 caracteres por token en español). Nada se envía a ningún servidor.

92tokens aprox.348 caracteres

Costo de enviarlo 1 000 veces (solo entrada)

  1. 1Gemma 3 4B Google$0.005
  2. 2Gemma 4 31B Google$0.008
  3. 3Claude Sonnet 5.5 Anthropic$0.184
  4. 4Claude Sonnet 5 Anthropic$0.184
  5. 5Claude Opus 5.5 Anthropic$0.368
  6. 6Claude Opus 5 Anthropic$0.460
  7. 7Claude Fable 5.1 Anthropic$0.920
  8. 8Claude Fable 5 Anthropic$0.920

Comparativas frecuentes

Preguntas frecuentes

¿Cuál conviene más por API: Gemma 3 4B vs Gemma 4 31B?

Gemma 3 4B cuesta 44 % menos en entrada y 71 % menos en salida que Gemma 4 31B ($0.050 / $0.100 frente a $0.090 / $0.340 por millón de tokens). Gemma 4 31B acepta más contexto (262 K). En capacidades, Gemma 4 31B tiene modo de razonamiento.

¿Cuál es más barato: Gemma 3 4B y Gemma 4 31B?

Gemma 3 4B es más barato: $0.050 por millón de tokens de entrada y $0.100 de salida, frente a $0.090 / $0.340 de Gemma 4 31B.

¿Cuál tiene más contexto: Gemma 3 4B y Gemma 4 31B?

Gemma 4 31B acepta 262 K tokens de contexto; Gemma 3 4B acepta 131 K.

¿Cuál es más reciente: Gemma 3 4B y Gemma 4 31B?

Gemma 4 31B salió el 02/04/2026; Gemma 3 4B, el 13/03/2025.

¿Cuánto costarían 10 000 peticiones al mes con Gemma 3 4B y Gemma 4 31B?

Con 1 500 tokens de entrada y 400 de salida por petición: Gemma 3 4B: $1.15; Gemma 4 31B: $2.71 al mes, a precio de lista.

¿De dónde salen los precios y cada cuánto se actualizan?

De los catálogos públicos de OpenRouter, models.dev y LiteLLM, que publican los precios de lista de cada proveedor. Se sincronizan una vez al día y la fecha de la última actualización aparece arriba de la comparativa.

¿Qué significa el precio por millón de tokens?

Es lo que cobra el proveedor por cada millón de tokens que envías (entrada) o que el modelo genera (salida). Un token equivale a unos 3 o 4 caracteres en español. La salida casi siempre cuesta más que la entrada.

Fuentes: OpenRouter, models.dev y LiteLLM. Precios en USD por millón de tokens, de lista, sin descuentos por volumen. Las descripciones vienen del catálogo en inglés. Los tokens del prompt son una estimación; el tokenizador de cada proveedor puede variar.