google logo
google

Google: Gemma 4 26B A4B

出典の説明(英語)

Gemma 4 26B A4B IT is an instruction-tuned Mixture-of-Experts (MoE) model from Google DeepMind. Despite 25.2B total parameters, only 3.8B activate per token during inference — delivering near-31B quality at...

概要

モデル仕様

コンテキスト
262,144 tokens
最大出力
235,929 tokens
アーキテクチャ
text+image+video->text
トークナイザー
Gemma
知識カットオフ
情報なし
モデレーション
いいえ
OPENROUTER

料金の詳細

OpenRouterと同期した料金です。トークン料金は100万トークン単位です。

入力
$0.09
100万トークンあたり
出力
$0.3
100万トークンあたり
キャッシュ読込
$0.05
100万トークンあたり
API

モデル設定

既定パラメータ

temperature
1
top_p
0.95
top_k
64

推論

推論の必須設定
いいえ
既定パラメータ
いいえ
API

クイックスタート

ローカルにOPENROUTER_API_KEYを設定してください。Pythonにはrequestsが必要です。JavaScriptはNode.jsで実行し、キーはサーバー側で管理してください。

APIドキュメント

curl --fail-with-body https://openrouter.ai/api/v1/chat/completions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"google/gemma-4-26b-a4b-it","messages":[{"role":"user","content":"Hello!"}]}'
機能とモダリティ

入力出力

入力
imagetextvideo
出力
text
推論

いいえ

API

対応APIパラメータ

frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokensmin_ppresence_penaltyreasoningrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p
利用可能なプロバイダー

11 プロバイダー

確認日: 2026年9月13日

OpenRouterでプロバイダーを見る

可用性、遅延、スループット、ルーティングは常時変化します。最新情報は出典ページで確認してください。

OpenRouter

Darkbloom

情報なし
コンテキスト
131K
最大出力
33K
入力
$0.042
出力
$0.22
キャッシュ読込
情報なし
キャッシュ書込
情報なし

DekaLLM

bf16
コンテキスト
262K
最大出力
236K
入力
$0.06
出力
$0.33
キャッシュ読込
情報なし
キャッシュ書込
情報なし

DeepInfra

fp8
コンテキスト
262K
最大出力
16K
入力
$0.07
出力
$0.34
キャッシュ読込
情報なし
キャッシュ書込
情報なし

NextBit

bf16
コンテキスト
262K
最大出力
236K
入力
$0.09
出力
$0.3
キャッシュ読込
$0.05
キャッシュ書込
情報なし

Cloudflare

情報なし
コンテキスト
256K
最大出力
230K
入力
$0.1
出力
$0.3
キャッシュ読込
情報なし
キャッシュ書込
情報なし

Makora

情報なし
コンテキスト
262K
最大出力
236K
入力
$0.1
出力
$0.34
キャッシュ読込
$0.034
キャッシュ書込
情報なし

Venice

bf16
コンテキスト
256K
最大出力
8K
入力
$0.13
出力
$0.4
キャッシュ読込
$0.05
キャッシュ書込
情報なし

Parasail

bf16
コンテキスト
262K
最大出力
236K
入力
$0.13
出力
$0.4
キャッシュ読込
$0.05
キャッシュ書込
情報なし

Novita

bf16
コンテキスト
262K
最大出力
131K
入力
$0.13
出力
$0.4
キャッシュ読込
情報なし
キャッシュ書込
情報なし

SiliconFlow

fp8
コンテキスト
262K
最大出力
236K
入力
$0.14
出力
$0.4
キャッシュ読込
$0.05
キャッシュ書込
情報なし

Google

情報なし
コンテキスト
262K
最大出力
236K
入力
$0.15
出力
$0.6
キャッシュ読込
情報なし
キャッシュ書込
情報なし
google

4 モデル

すべてのモデル
google logogoogle

Google: Gemini 3.8 Flash

Gemini 3.8 Flash is Google's most intelligent Flash model with significant gains from 3.7 Flash across software engineering, agentic tasks, and multi-step reasoning.

コンテキスト
1.0M
入力
text · image · video · file · audio
出力
text
入力: $0.75出力: $3.75100万トークンあたり
モデル詳細を見る
google logogoogle

Google: Gemini 3.8 Flash (batch)

Gemini 3.8 Flash is Google's most intelligent Flash model with significant gains from 3.7 Flash across software engineering, agentic tasks, and multi-step reasoning.

コンテキスト
1.0M
入力
text · image · video · file · audio
出力
text
入力: $0.375出力: $1.875100万トークンあたり
モデル詳細を見る
google logogoogle

Google: Gemini 3.7 Flash

Gemini 3.7 Flash is a multimodal model from Google for fast agentic workflows, coding, and complex multi-step reasoning. It is designed for tasks that require responsive performance and reliable multi-step...

コンテキスト
1.0M
入力
text · image · video · file · audio
出力
text
入力: $0.75出力: $3.75100万トークンあたり
モデル詳細を見る
google logogoogle

Google: Gemini 3.7 Flash (batch)

Gemini 3.7 Flash is a multimodal model from Google for fast agentic workflows, coding, and complex multi-step reasoning. It is designed for tasks that require responsive performance and reliable multi-step...

コンテキスト
1.0M
入力
text · image · video · file · audio
出力
text
入力: $0.375出力: $1.875100万トークンあたり
モデル詳細を見る