google logo
google

Google: Gemma 4 31B

Gemma 4 31B Instruct is Google DeepMind's 30.7B dense multimodal model supporting text and image input with text output. $0.09 per million input tokens, $0.34 per million output tokens. 262,144 token context window, maximum output of 16,384 tokens. Higher uptime with 15 providers. Includes independent benchmarks from Artificial Analysis.

Visão geral

Especificações do modelo

Contexto
262.144 tokens
Saída máxima
16.384 tokens
Arquitetura
text+image+video->text
Tokenizador
Gemma
Limite de conhecimento
Não informado
Moderado
Não
OPENROUTER

Preços completos

Tarifas sincronizadas do OpenRouter, por milhão de tokens.

Entrada
$0.09
/M tokens
Saída
$0.34
/M tokens
Leitura de cache
$0.05
/M tokens
API

Configuração do modelo

Parâmetros padrão

temperature
1
top_p
0.95
top_k
64

Raciocínio

Moderado
Não
Parâmetros padrão
Não
API

Início rápido

Use este modelo pela API compatível com OpenAI do OpenRouter.

curl https://openrouter.ai/api/v1/chat/completions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"google/gemma-4-31b-it","messages":[{"role":"user","content":"Hello!"}]}'
Recursos e modalidades

EntradaSaída

Entrada
imagetextvideo
Saída
text
Raciocínio

Não

API

Parâmetros de API compatíveis

frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokensmin_ppresence_penaltyreasoningrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p
Provedores disponíveis

16 provedores

Provedores ao vivo no OpenRouter

Disponibilidade, latência, throughput e roteamento mudam continuamente. Consulte a fonte para dados atuais.

OpenRouter

DeepInfra

fp4
Contexto
262K
Saída máxima
16K
Entrada
$0.090
Saída
$0.340
Leitura de cache
$0.050
Gravação de cache
Não informado

CoreWeave

fp4
Contexto
262K
Saída máxima
236K
Entrada
$0.100
Saída
$0.340
Leitura de cache
$0.100
Gravação de cache
Não informado

Venice

bf16
Contexto
256K
Saída máxima
8K
Entrada
$0.120
Saída
$0.360
Leitura de cache
$0.090
Gravação de cache
Não informado

Chutes

fp4
Contexto
131K
Saída máxima
66K
Entrada
$0.120
Saída
$0.370
Leitura de cache
$0.012
Gravação de cache
Não informado

DeepInfra

fp8
Contexto
262K
Saída máxima
16K
Entrada
$0.130
Saída
$0.380
Leitura de cache
Não informado
Gravação de cache
Não informado

SiliconFlow

fp8
Contexto
262K
Saída máxima
236K
Entrada
$0.130
Saída
$0.400
Leitura de cache
Não informado
Gravação de cache
Não informado

Crusoe

unknown
Contexto
262K
Saída máxima
262K
Entrada
$0.140
Saída
$0.400
Leitura de cache
$0.140
Gravação de cache
Não informado

Friendli

unknown
Contexto
262K
Saída máxima
8K
Entrada
$0.140
Saída
$0.400
Leitura de cache
Não informado
Gravação de cache
Não informado

Novita

bf16
Contexto
262K
Saída máxima
131K
Entrada
$0.140
Saída
$0.400
Leitura de cache
Não informado
Gravação de cache
Não informado

Parasail

fp8
Contexto
262K
Saída máxima
236K
Entrada
$0.150
Saída
$0.400
Leitura de cache
$0.060
Gravação de cache
Não informado

Phala

unknown
Contexto
262K
Saída máxima
236K
Entrada
$0.150
Saída
$0.460
Leitura de cache
$0.075
Gravação de cache
Não informado

DeepInfra

fp8
Contexto
131K
Saída máxima
8K
Entrada
$0.270
Saída
$0.760
Leitura de cache
Não informado
Gravação de cache
Não informado

SambaNova

unknown
Contexto
131K
Saída máxima
118K
Entrada
$0.380
Saída
$1.15
Leitura de cache
Não informado
Gravação de cache
Não informado

Together

unknown
Contexto
262K
Saída máxima
236K
Entrada
$0.390
Saída
$0.970
Leitura de cache
Não informado
Gravação de cache
Não informado

ModelRun

fp4
Contexto
262K
Saída máxima
236K
Entrada
$0.750
Saída
$1.00
Leitura de cache
$0.750
Gravação de cache
Não informado

Cerebras

fp16
Contexto
131K
Saída máxima
41K
Entrada
$0.990
Saída
$1.49
Leitura de cache
$0.990
Gravação de cache
Não informado
google

modelos

Todos os modelos
google logogoogle

Google: Gemini 3.7 Flash

Gemini 3.7 Flash is a multimodal model from Google for fast agentic workflows, coding, and complex multi-step reasoning. It is designed for tasks that require responsive performance and reliable multi-step...

Contexto
1.0M
Entrada
text · image · video · file · audio
Saída
text
Entrada: $0.750Saída: $3.75por milhão de tokens
Ver detalhes do modelo
google logogoogle

Google: Gemini 3.7 Flash (batch)

Gemini 3.7 Flash is a multimodal model from Google for fast agentic workflows, coding, and complex multi-step reasoning. It is designed for tasks that require responsive performance and reliable multi-step...

Contexto
1.0M
Entrada
text · image · video · file · audio
Saída
text
Entrada: $0.188Saída: $0.938por milhão de tokens
Ver detalhes do modelo
google logogoogle

Google: Gemini 3.6 Flash

Gemini 3.6 Flash is a high-efficiency model from Google for coding, agentic workflows, and web and app development. It is designed to produce polished outputs with fewer unnecessary edits and...

Contexto
1.0M
Entrada
text · image · video · file · audio
Saída
text
Entrada: $0.750Saída: $3.75por milhão de tokens
Ver detalhes do modelo
google logogoogle

Google: Gemini 3.6 Flash (batch)

Gemini 3.6 Flash is a high-efficiency model from Google for coding, agentic workflows, and web and app development. It is designed to produce polished outputs with fewer unnecessary edits and...

Contexto
1.0M
Entrada
text · image · video · file · audio
Saída
text
Entrada: $0.375Saída: $1.88por milhão de tokens
Ver detalhes do modelo