google logo
google

Google: Gemma 4 31B

出典の説明(英語)

Gemma 4 31B Instruct is Google DeepMind's 30.7B dense multimodal model supporting text and image input with text output. Features a 256K token context window, configurable thinking/reasoning mode, native function...

概要

モデル仕様

コンテキスト
262,144 tokens
最大出力
16,384 tokens
アーキテクチャ
text+image+video->text
トークナイザー
Gemma
知識カットオフ
情報なし
モデレーション
いいえ
OPENROUTER

料金の詳細

OpenRouterと同期した料金です。トークン料金は100万トークン単位です。

入力
$0.09
100万トークンあたり
出力
$0.34
100万トークンあたり
キャッシュ読込
$0.05
100万トークンあたり
API

モデル設定

既定パラメータ

temperature
1
top_p
0.95
top_k
64

推論

推論の必須設定
いいえ
既定パラメータ
いいえ
API

クイックスタート

ローカルにOPENROUTER_API_KEYを設定してください。Pythonにはrequestsが必要です。JavaScriptはNode.jsで実行し、キーはサーバー側で管理してください。

APIドキュメント

curl --fail-with-body https://openrouter.ai/api/v1/chat/completions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"google/gemma-4-31b-it","messages":[{"role":"user","content":"Hello!"}]}'
機能とモダリティ

入力出力

入力
imagetextvideo
出力
text
推論

いいえ

API

対応APIパラメータ

frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokensmin_ppresence_penaltyreasoningrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p
利用可能なプロバイダー

15 プロバイダー

確認日: 2026年9月7日

OpenRouterでプロバイダーを見る

可用性、遅延、スループット、ルーティングは常時変化します。最新情報は出典ページで確認してください。

OpenRouter

DeepInfra

fp4
コンテキスト
262K
最大出力
16K
入力
$0.09
出力
$0.34
キャッシュ読込
$0.05
キャッシュ書込
情報なし

CoreWeave

fp4
コンテキスト
262K
最大出力
236K
入力
$0.1
出力
$0.34
キャッシュ読込
$0.1
キャッシュ書込
情報なし

Venice

bf16
コンテキスト
256K
最大出力
8K
入力
$0.12
出力
$0.36
キャッシュ読込
$0.09
キャッシュ書込
情報なし

Chutes

fp4
コンテキスト
131K
最大出力
66K
入力
$0.12
出力
$0.37
キャッシュ読込
$0.012
キャッシュ書込
情報なし

DeepInfra

fp8
コンテキスト
262K
最大出力
16K
入力
$0.13
出力
$0.38
キャッシュ読込
情報なし
キャッシュ書込
情報なし

SiliconFlow

fp8
コンテキスト
262K
最大出力
236K
入力
$0.13
出力
$0.4
キャッシュ読込
情報なし
キャッシュ書込
情報なし

Crusoe

情報なし
コンテキスト
262K
最大出力
262K
入力
$0.14
出力
$0.4
キャッシュ読込
$0.14
キャッシュ書込
情報なし

Friendli

情報なし
コンテキスト
262K
最大出力
8K
入力
$0.14
出力
$0.4
キャッシュ読込
情報なし
キャッシュ書込
情報なし

Novita

bf16
コンテキスト
262K
最大出力
131K
入力
$0.14
出力
$0.4
キャッシュ読込
情報なし
キャッシュ書込
情報なし

Parasail

fp8
コンテキスト
262K
最大出力
236K
入力
$0.15
出力
$0.4
キャッシュ読込
$0.06
キャッシュ書込
情報なし

DeepInfra

fp8
コンテキスト
131K
最大出力
8K
入力
$0.27
出力
$0.76
キャッシュ読込
情報なし
キャッシュ書込
情報なし

SambaNova

情報なし
コンテキスト
131K
最大出力
118K
入力
$0.38
出力
$1.15
キャッシュ読込
情報なし
キャッシュ書込
情報なし

Together

情報なし
コンテキスト
262K
最大出力
236K
入力
$0.39
出力
$0.97
キャッシュ読込
情報なし
キャッシュ書込
情報なし

ModelRun

fp4
コンテキスト
262K
最大出力
236K
入力
$0.75
出力
$1
キャッシュ読込
$0.75
キャッシュ書込
情報なし

Cerebras

fp16
コンテキスト
131K
最大出力
41K
入力
$0.99
出力
$1.49
キャッシュ読込
$0.99
キャッシュ書込
情報なし
google

4 モデル

すべてのモデル
google logogoogle

Google: Gemini 3.8 Flash

Gemini 3.8 Flash is Google's most intelligent Flash model with significant gains from 3.7 Flash across software engineering, agentic tasks, and multi-step reasoning.

コンテキスト
1.0M
入力
text · image · video · file · audio
出力
text
入力: $0.75出力: $3.75100万トークンあたり
モデル詳細を見る
google logogoogle

Google: Gemini 3.8 Flash (batch)

Gemini 3.8 Flash is Google's most intelligent Flash model with significant gains from 3.7 Flash across software engineering, agentic tasks, and multi-step reasoning.

コンテキスト
1.0M
入力
text · image · video · file · audio
出力
text
入力: $0.375出力: $1.875100万トークンあたり
モデル詳細を見る
google logogoogle

Google: Gemini 3.7 Flash

Gemini 3.7 Flash is a multimodal model from Google for fast agentic workflows, coding, and complex multi-step reasoning. It is designed for tasks that require responsive performance and reliable multi-step...

コンテキスト
1.0M
入力
text · image · video · file · audio
出力
text
入力: $0.75出力: $3.75100万トークンあたり
モデル詳細を見る
google logogoogle

Google: Gemini 3.7 Flash (batch)

Gemini 3.7 Flash is a multimodal model from Google for fast agentic workflows, coding, and complex multi-step reasoning. It is designed for tasks that require responsive performance and reliable multi-step...

コンテキスト
1.0M
入力
text · image · video · file · audio
出力
text
入力: $0.375出力: $1.875100万トークンあたり
モデル詳細を見る