google logo
google

Google: Gemma 4 26B A4B

Gemma 4 26B A4B IT is an instruction-tuned Mixture-of-Experts (MoE) model from Google DeepMind. $0.042 per million input tokens, $0.22 per million output tokens. 262,144 token context window, maximum output of 32,768 tokens. Higher uptime with 10 providers. Includes independent benchmarks from Artificial Analysis.

Przegląd

Specyfikacja modelu

Kontekst
262 144 tokens
Maksymalne wyjście
16 384 tokens
Architektura
text+image+video->text
Tokenizer
Gemma
Granica wiedzy
Brak danych
Moderowany
Nie
OPENROUTER

Pełny cennik

Stawki zsynchronizowane z OpenRouter, za milion tokenów.

Wejście
$0.042
/M tokens
Wyjście
$0.22
/M tokens
API

Konfiguracja modelu

Parametry domyślne

temperature
1
top_p
0.95
top_k
64

Rozumowanie

Moderowany
Nie
Parametry domyślne
Nie
API

Szybki start

Wywołaj ten model przez zgodne z OpenAI API OpenRouter.

curl https://openrouter.ai/api/v1/chat/completions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"google/gemma-4-26b-a4b-it","messages":[{"role":"user","content":"Hello!"}]}'
Możliwości i modalności

WejścieWyjście

Wejście
imagetextvideo
Wyjście
text
Rozumowanie

Nie

API

Obsługiwane parametry API

frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokensmin_ppresence_penaltyreasoningrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p
Dostępni dostawcy

9 dostawców

Dostawcy na żywo w OpenRouter

Dostępność, opóźnienie, przepustowość i routing stale się zmieniają. Aktualne dane są na stronie źródłowej.

OpenRouter

Darkbloom

unknown
Kontekst
131K
Maksymalne wyjście
33K
Wejście
$0.042
Wyjście
$0.220
Odczyt pamięci podręcznej
Brak danych
Zapis pamięci podręcznej
Brak danych

DeepInfra

fp8
Kontekst
262K
Maksymalne wyjście
16K
Wejście
$0.070
Wyjście
$0.340
Odczyt pamięci podręcznej
Brak danych
Zapis pamięci podręcznej
Brak danych

Cloudflare

unknown
Kontekst
256K
Maksymalne wyjście
230K
Wejście
$0.100
Wyjście
$0.300
Odczyt pamięci podręcznej
Brak danych
Zapis pamięci podręcznej
Brak danych

NextBit

bf16
Kontekst
262K
Maksymalne wyjście
236K
Wejście
$0.100
Wyjście
$0.400
Odczyt pamięci podręcznej
$0.050
Zapis pamięci podręcznej
Brak danych

SiliconFlow

fp8
Kontekst
262K
Maksymalne wyjście
236K
Wejście
$0.120
Wyjście
$0.400
Odczyt pamięci podręcznej
Brak danych
Zapis pamięci podręcznej
Brak danych

Novita

bf16
Kontekst
262K
Maksymalne wyjście
131K
Wejście
$0.130
Wyjście
$0.400
Odczyt pamięci podręcznej
Brak danych
Zapis pamięci podręcznej
Brak danych

Venice

bf16
Kontekst
256K
Maksymalne wyjście
8K
Wejście
$0.130
Wyjście
$0.400
Odczyt pamięci podręcznej
$0.050
Zapis pamięci podręcznej
Brak danych

Parasail

bf16
Kontekst
262K
Maksymalne wyjście
236K
Wejście
$0.130
Wyjście
$0.400
Odczyt pamięci podręcznej
$0.050
Zapis pamięci podręcznej
Brak danych

Google

unknown
Kontekst
262K
Maksymalne wyjście
236K
Wejście
$0.150
Wyjście
$0.600
Odczyt pamięci podręcznej
Brak danych
Zapis pamięci podręcznej
Brak danych
google

modele

Wszystkie modele
google logogoogle

Google: Gemini 3.7 Flash

Gemini 3.7 Flash is a multimodal model from Google for fast agentic workflows, coding, and complex multi-step reasoning. It is designed for tasks that require responsive performance and reliable multi-step...

Kontekst
1.0M
Wejście
text · image · video · file · audio
Wyjście
text
Wejście: $0.750Wyjście: $3.75za milion tokenów
Zobacz szczegóły modelu
google logogoogle

Google: Gemini 3.7 Flash (batch)

Gemini 3.7 Flash is a multimodal model from Google for fast agentic workflows, coding, and complex multi-step reasoning. It is designed for tasks that require responsive performance and reliable multi-step...

Kontekst
1.0M
Wejście
text · image · video · file · audio
Wyjście
text
Wejście: $0.188Wyjście: $0.938za milion tokenów
Zobacz szczegóły modelu
google logogoogle

Google: Gemini 3.6 Flash

Gemini 3.6 Flash is a high-efficiency model from Google for coding, agentic workflows, and web and app development. It is designed to produce polished outputs with fewer unnecessary edits and...

Kontekst
1.0M
Wejście
text · image · video · file · audio
Wyjście
text
Wejście: $0.750Wyjście: $3.75za milion tokenów
Zobacz szczegóły modelu
google logogoogle

Google: Gemini 3.6 Flash (batch)

Gemini 3.6 Flash is a high-efficiency model from Google for coding, agentic workflows, and web and app development. It is designed to produce polished outputs with fewer unnecessary edits and...

Kontekst
1.0M
Wejście
text · image · video · file · audio
Wyjście
text
Wejście: $0.375Wyjście: $1.88za milion tokenów
Zobacz szczegóły modelu