google logo
google

Google: Gemma 4 31B (free)

Gemma 4 31B Instruct is Google DeepMind's 30.7B dense multimodal model supporting text and image input with text output. This model is free to use. 262,144 token context window, maximum output of 32,768 tokens. Higher uptime with 15 providers. Includes independent benchmarks from Artificial Analysis.

Resumen

Especificaciones del modelo

Contexto
262.144 tokens
Salida máxima
32.768 tokens
Arquitectura
text+image+video->text
Tokenizador
Gemma
Corte de conocimiento
No indicado
Moderado
No
OPENROUTER

Precios completos

Tarifas sincronizadas desde OpenRouter, por millón de tokens.

Entrada
Gratis
/M tokens
Salida
Gratis
/M tokens
API

Configuración del modelo

Parámetros predeterminados

temperature
1
top_p
0.95
top_k
64

Razonamiento

Moderado
No
Parámetros predeterminados
No
API

Inicio rápido

Usa este modelo mediante la API compatible con OpenAI de OpenRouter.

curl https://openrouter.ai/api/v1/chat/completions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"google/gemma-4-31b-it:free","messages":[{"role":"user","content":"Hello!"}]}'
Capacidades y modalidades

EntradaSalida

Entrada
imagetextvideo
Salida
text
Razonamiento

No

API

Parámetros API compatibles

include_reasoningmax_tokensreasoningresponse_formatseedtemperaturetool_choicetoolstop_p
Proveedores disponibles

16 proveedores

Proveedores en vivo en OpenRouter

Disponibilidad, latencia, rendimiento y enrutamiento cambian continuamente. Consulta la fuente para datos actuales.

OpenRouter

DeepInfra

fp4
Contexto
262K
Salida máxima
16K
Entrada
$0.090
Salida
$0.340
Lectura de caché
$0.050
Escritura de caché
No indicado

CoreWeave

fp4
Contexto
262K
Salida máxima
236K
Entrada
$0.100
Salida
$0.340
Lectura de caché
$0.100
Escritura de caché
No indicado

Venice

bf16
Contexto
256K
Salida máxima
8K
Entrada
$0.120
Salida
$0.360
Lectura de caché
$0.090
Escritura de caché
No indicado

Chutes

fp4
Contexto
131K
Salida máxima
66K
Entrada
$0.120
Salida
$0.370
Lectura de caché
$0.012
Escritura de caché
No indicado

DeepInfra

fp8
Contexto
262K
Salida máxima
16K
Entrada
$0.130
Salida
$0.380
Lectura de caché
No indicado
Escritura de caché
No indicado

SiliconFlow

fp8
Contexto
262K
Salida máxima
236K
Entrada
$0.130
Salida
$0.400
Lectura de caché
No indicado
Escritura de caché
No indicado

Crusoe

unknown
Contexto
262K
Salida máxima
262K
Entrada
$0.140
Salida
$0.400
Lectura de caché
$0.140
Escritura de caché
No indicado

Friendli

unknown
Contexto
262K
Salida máxima
8K
Entrada
$0.140
Salida
$0.400
Lectura de caché
No indicado
Escritura de caché
No indicado

Novita

bf16
Contexto
262K
Salida máxima
131K
Entrada
$0.140
Salida
$0.400
Lectura de caché
No indicado
Escritura de caché
No indicado

Parasail

fp8
Contexto
262K
Salida máxima
236K
Entrada
$0.150
Salida
$0.400
Lectura de caché
$0.060
Escritura de caché
No indicado

Phala

unknown
Contexto
262K
Salida máxima
236K
Entrada
$0.150
Salida
$0.460
Lectura de caché
$0.075
Escritura de caché
No indicado

DeepInfra

fp8
Contexto
131K
Salida máxima
8K
Entrada
$0.270
Salida
$0.760
Lectura de caché
No indicado
Escritura de caché
No indicado

SambaNova

unknown
Contexto
131K
Salida máxima
118K
Entrada
$0.380
Salida
$1.15
Lectura de caché
No indicado
Escritura de caché
No indicado

Together

unknown
Contexto
262K
Salida máxima
236K
Entrada
$0.390
Salida
$0.970
Lectura de caché
No indicado
Escritura de caché
No indicado

ModelRun

fp4
Contexto
262K
Salida máxima
236K
Entrada
$0.750
Salida
$1.00
Lectura de caché
$0.750
Escritura de caché
No indicado

Cerebras

fp16
Contexto
131K
Salida máxima
41K
Entrada
$0.990
Salida
$1.49
Lectura de caché
$0.990
Escritura de caché
No indicado
google

modelos

Todos los modelos
google logogoogle

Google: Gemini 3.7 Flash

Gemini 3.7 Flash is a multimodal model from Google for fast agentic workflows, coding, and complex multi-step reasoning. It is designed for tasks that require responsive performance and reliable multi-step...

Contexto
1.0M
Entrada
text · image · video · file · audio
Salida
text
Entrada: $0.750Salida: $3.75por millón de tokens
Ver detalles del modelo
google logogoogle

Google: Gemini 3.7 Flash (batch)

Gemini 3.7 Flash is a multimodal model from Google for fast agentic workflows, coding, and complex multi-step reasoning. It is designed for tasks that require responsive performance and reliable multi-step...

Contexto
1.0M
Entrada
text · image · video · file · audio
Salida
text
Entrada: $0.188Salida: $0.938por millón de tokens
Ver detalles del modelo
google logogoogle

Google: Gemini 3.6 Flash

Gemini 3.6 Flash is a high-efficiency model from Google for coding, agentic workflows, and web and app development. It is designed to produce polished outputs with fewer unnecessary edits and...

Contexto
1.0M
Entrada
text · image · video · file · audio
Salida
text
Entrada: $0.750Salida: $3.75por millón de tokens
Ver detalles del modelo
google logogoogle

Google: Gemini 3.6 Flash (batch)

Gemini 3.6 Flash is a high-efficiency model from Google for coding, agentic workflows, and web and app development. It is designed to produce polished outputs with fewer unnecessary edits and...

Contexto
1.0M
Entrada
text · image · video · file · audio
Salida
text
Entrada: $0.375Salida: $1.88por millón de tokens
Ver detalles del modelo