google logo
google

Google: Gemma 4 26B A4B (free)

Gemma 4 26B A4B IT is an instruction-tuned Mixture-of-Experts (MoE) model from Google DeepMind. This model is free to use. 262,144 token context window, maximum output of 32,768 tokens. Higher uptime with 10 providers. Includes independent benchmarks from Artificial Analysis.

Panoramica

Specifiche del modello

Contesto
262.144 tokens
Output massimo
32.768 tokens
Architettura
text+image+video->text
Tokenizer
Gemma
Limite di conoscenza
Non indicato
Moderato
No
OPENROUTER

Prezzi completi

Tariffe sincronizzate da OpenRouter, per milione di token.

Input
Gratuito
/M tokens
Output
Gratuito
/M tokens
API

Configurazione del modello

Parametri predefiniti

temperature
1
top_p
0.95
top_k
64

Ragionamento

Moderato
No
Parametri predefiniti
No
API

Avvio rapido

Chiama questo modello tramite l’API compatibile OpenAI di OpenRouter.

curl https://openrouter.ai/api/v1/chat/completions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"google/gemma-4-26b-a4b-it:free","messages":[{"role":"user","content":"Hello!"}]}'
Capacità e modalità

InputOutput

Input
imagetextvideo
Output
text
Ragionamento

No

API

Parametri API supportati

include_reasoningmax_tokensreasoningresponse_formatseedtemperaturetool_choicetoolstop_p
Provider disponibili

9 provider

Provider live su OpenRouter

Disponibilità, latenza, throughput e routing cambiano continuamente. Consulta la fonte per i dati correnti.

OpenRouter

Darkbloom

unknown
Contesto
131K
Output massimo
33K
Input
$0.042
Output
$0.220
Lettura cache
Non indicato
Scrittura cache
Non indicato

DeepInfra

fp8
Contesto
262K
Output massimo
16K
Input
$0.070
Output
$0.340
Lettura cache
Non indicato
Scrittura cache
Non indicato

Cloudflare

unknown
Contesto
256K
Output massimo
230K
Input
$0.100
Output
$0.300
Lettura cache
Non indicato
Scrittura cache
Non indicato

NextBit

bf16
Contesto
262K
Output massimo
236K
Input
$0.100
Output
$0.400
Lettura cache
$0.050
Scrittura cache
Non indicato

SiliconFlow

fp8
Contesto
262K
Output massimo
236K
Input
$0.120
Output
$0.400
Lettura cache
Non indicato
Scrittura cache
Non indicato

Novita

bf16
Contesto
262K
Output massimo
131K
Input
$0.130
Output
$0.400
Lettura cache
Non indicato
Scrittura cache
Non indicato

Venice

bf16
Contesto
256K
Output massimo
8K
Input
$0.130
Output
$0.400
Lettura cache
$0.050
Scrittura cache
Non indicato

Parasail

bf16
Contesto
262K
Output massimo
236K
Input
$0.130
Output
$0.400
Lettura cache
$0.050
Scrittura cache
Non indicato

Google

unknown
Contesto
262K
Output massimo
236K
Input
$0.150
Output
$0.600
Lettura cache
Non indicato
Scrittura cache
Non indicato
google

modelli

Tutti i modelli
google logogoogle

Google: Gemini 3.7 Flash

Gemini 3.7 Flash is a multimodal model from Google for fast agentic workflows, coding, and complex multi-step reasoning. It is designed for tasks that require responsive performance and reliable multi-step...

Contesto
1.0M
Input
text · image · video · file · audio
Output
text
Input: $0.750Output: $3.75per milione di token
Vedi i dettagli del modello
google logogoogle

Google: Gemini 3.7 Flash (batch)

Gemini 3.7 Flash is a multimodal model from Google for fast agentic workflows, coding, and complex multi-step reasoning. It is designed for tasks that require responsive performance and reliable multi-step...

Contesto
1.0M
Input
text · image · video · file · audio
Output
text
Input: $0.188Output: $0.938per milione di token
Vedi i dettagli del modello
google logogoogle

Google: Gemini 3.6 Flash

Gemini 3.6 Flash is a high-efficiency model from Google for coding, agentic workflows, and web and app development. It is designed to produce polished outputs with fewer unnecessary edits and...

Contesto
1.0M
Input
text · image · video · file · audio
Output
text
Input: $0.750Output: $3.75per milione di token
Vedi i dettagli del modello
google logogoogle

Google: Gemini 3.6 Flash (batch)

Gemini 3.6 Flash is a high-efficiency model from Google for coding, agentic workflows, and web and app development. It is designed to produce polished outputs with fewer unnecessary edits and...

Contesto
1.0M
Input
text · image · video · file · audio
Output
text
Input: $0.375Output: $1.88per milione di token
Vedi i dettagli del modello