google logo
google

Google: Gemma 4 31B

Gemma 4 31B Instruct is Google DeepMind's 30.7B dense multimodal model supporting text and image input with text output. $0.09 per million input tokens, $0.34 per million output tokens. 262,144 token context window, maximum output of 16,384 tokens. Higher uptime with 15 providers. Includes independent benchmarks from Artificial Analysis.

Przegląd

Specyfikacja modelu

Kontekst
262 144 tokens
Maksymalne wyjście
16 384 tokens
Architektura
text+image+video->text
Tokenizer
Gemma
Granica wiedzy
Brak danych
Moderowany
Nie
OPENROUTER

Pełny cennik

Stawki zsynchronizowane z OpenRouter, za milion tokenów.

Wejście
$0.09
/M tokens
Wyjście
$0.34
/M tokens
Odczyt pamięci podręcznej
$0.05
/M tokens
API

Konfiguracja modelu

Parametry domyślne

temperature
1
top_p
0.95
top_k
64

Rozumowanie

Moderowany
Nie
Parametry domyślne
Nie
API

Szybki start

Wywołaj ten model przez zgodne z OpenAI API OpenRouter.

curl https://openrouter.ai/api/v1/chat/completions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"google/gemma-4-31b-it","messages":[{"role":"user","content":"Hello!"}]}'
Możliwości i modalności

WejścieWyjście

Wejście
imagetextvideo
Wyjście
text
Rozumowanie

Nie

API

Obsługiwane parametry API

frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokensmin_ppresence_penaltyreasoningrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p
Dostępni dostawcy

16 dostawców

Dostawcy na żywo w OpenRouter

Dostępność, opóźnienie, przepustowość i routing stale się zmieniają. Aktualne dane są na stronie źródłowej.

OpenRouter

DeepInfra

fp4
Kontekst
262K
Maksymalne wyjście
16K
Wejście
$0.090
Wyjście
$0.340
Odczyt pamięci podręcznej
$0.050
Zapis pamięci podręcznej
Brak danych

CoreWeave

fp4
Kontekst
262K
Maksymalne wyjście
236K
Wejście
$0.100
Wyjście
$0.340
Odczyt pamięci podręcznej
$0.100
Zapis pamięci podręcznej
Brak danych

Venice

bf16
Kontekst
256K
Maksymalne wyjście
8K
Wejście
$0.120
Wyjście
$0.360
Odczyt pamięci podręcznej
$0.090
Zapis pamięci podręcznej
Brak danych

Chutes

fp4
Kontekst
131K
Maksymalne wyjście
66K
Wejście
$0.120
Wyjście
$0.370
Odczyt pamięci podręcznej
$0.012
Zapis pamięci podręcznej
Brak danych

DeepInfra

fp8
Kontekst
262K
Maksymalne wyjście
16K
Wejście
$0.130
Wyjście
$0.380
Odczyt pamięci podręcznej
Brak danych
Zapis pamięci podręcznej
Brak danych

SiliconFlow

fp8
Kontekst
262K
Maksymalne wyjście
236K
Wejście
$0.130
Wyjście
$0.400
Odczyt pamięci podręcznej
Brak danych
Zapis pamięci podręcznej
Brak danych

Crusoe

unknown
Kontekst
262K
Maksymalne wyjście
262K
Wejście
$0.140
Wyjście
$0.400
Odczyt pamięci podręcznej
$0.140
Zapis pamięci podręcznej
Brak danych

Friendli

unknown
Kontekst
262K
Maksymalne wyjście
8K
Wejście
$0.140
Wyjście
$0.400
Odczyt pamięci podręcznej
Brak danych
Zapis pamięci podręcznej
Brak danych

Novita

bf16
Kontekst
262K
Maksymalne wyjście
131K
Wejście
$0.140
Wyjście
$0.400
Odczyt pamięci podręcznej
Brak danych
Zapis pamięci podręcznej
Brak danych

Parasail

fp8
Kontekst
262K
Maksymalne wyjście
236K
Wejście
$0.150
Wyjście
$0.400
Odczyt pamięci podręcznej
$0.060
Zapis pamięci podręcznej
Brak danych

Phala

unknown
Kontekst
262K
Maksymalne wyjście
236K
Wejście
$0.150
Wyjście
$0.460
Odczyt pamięci podręcznej
$0.075
Zapis pamięci podręcznej
Brak danych

DeepInfra

fp8
Kontekst
131K
Maksymalne wyjście
8K
Wejście
$0.270
Wyjście
$0.760
Odczyt pamięci podręcznej
Brak danych
Zapis pamięci podręcznej
Brak danych

SambaNova

unknown
Kontekst
131K
Maksymalne wyjście
118K
Wejście
$0.380
Wyjście
$1.15
Odczyt pamięci podręcznej
Brak danych
Zapis pamięci podręcznej
Brak danych

Together

unknown
Kontekst
262K
Maksymalne wyjście
236K
Wejście
$0.390
Wyjście
$0.970
Odczyt pamięci podręcznej
Brak danych
Zapis pamięci podręcznej
Brak danych

ModelRun

fp4
Kontekst
262K
Maksymalne wyjście
236K
Wejście
$0.750
Wyjście
$1.00
Odczyt pamięci podręcznej
$0.750
Zapis pamięci podręcznej
Brak danych

Cerebras

fp16
Kontekst
131K
Maksymalne wyjście
41K
Wejście
$0.990
Wyjście
$1.49
Odczyt pamięci podręcznej
$0.990
Zapis pamięci podręcznej
Brak danych
google

modele

Wszystkie modele
google logogoogle

Google: Gemini 3.7 Flash

Gemini 3.7 Flash is a multimodal model from Google for fast agentic workflows, coding, and complex multi-step reasoning. It is designed for tasks that require responsive performance and reliable multi-step...

Kontekst
1.0M
Wejście
text · image · video · file · audio
Wyjście
text
Wejście: $0.750Wyjście: $3.75za milion tokenów
Zobacz szczegóły modelu
google logogoogle

Google: Gemini 3.7 Flash (batch)

Gemini 3.7 Flash is a multimodal model from Google for fast agentic workflows, coding, and complex multi-step reasoning. It is designed for tasks that require responsive performance and reliable multi-step...

Kontekst
1.0M
Wejście
text · image · video · file · audio
Wyjście
text
Wejście: $0.188Wyjście: $0.938za milion tokenów
Zobacz szczegóły modelu
google logogoogle

Google: Gemini 3.6 Flash

Gemini 3.6 Flash is a high-efficiency model from Google for coding, agentic workflows, and web and app development. It is designed to produce polished outputs with fewer unnecessary edits and...

Kontekst
1.0M
Wejście
text · image · video · file · audio
Wyjście
text
Wejście: $0.750Wyjście: $3.75za milion tokenów
Zobacz szczegóły modelu
google logogoogle

Google: Gemini 3.6 Flash (batch)

Gemini 3.6 Flash is a high-efficiency model from Google for coding, agentic workflows, and web and app development. It is designed to produce polished outputs with fewer unnecessary edits and...

Kontekst
1.0M
Wejście
text · image · video · file · audio
Wyjście
text
Wejście: $0.375Wyjście: $1.88za milion tokenów
Zobacz szczegóły modelu