google logo
google

Google: Gemma 4 26B A4B (free)

Descrição da fonte (inglês)

Gemma 4 26B A4B IT is an instruction-tuned Mixture-of-Experts (MoE) model from Google DeepMind. Despite 25.2B total parameters, only 3.8B activate per token during inference — delivering near-31B quality at...

Visão geral

Especificações do modelo

Contexto
262.144 tokens
Saída máxima
32.768 tokens
Arquitetura
text+image+video->text
Tokenizador
Gemma
Limite de conhecimento
Não informado
Moderado
Não
OPENROUTER

Preços completos

Tarifas sincronizadas do OpenRouter, por milhão de tokens.

Entrada
Grátis
por milhão de tokens
Saída
Grátis
por milhão de tokens
API

Configuração do modelo

Parâmetros padrão

temperature
1
top_p
0.95
top_k
64

Raciocínio

Raciocínio obrigatório
Não
Parâmetros padrão
Não
API

Início rápido

Defina OPENROUTER_API_KEY localmente. Python requer requests; JavaScript roda em Node.js. Mantenha a chave no servidor.

Documentação da API

curl --fail-with-body https://openrouter.ai/api/v1/chat/completions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"google/gemma-4-26b-a4b-it:free","messages":[{"role":"user","content":"Hello!"}]}'
Recursos e modalidades

EntradaSaída

Entrada
imagetextvideo
Saída
text
Raciocínio

Não

API

Parâmetros de API compatíveis

include_reasoningmax_tokensreasoningresponse_formatseedtemperaturetool_choicetoolstop_p
Provedores disponíveis

1 Provedor

Verificado: 7 de setembro de 2026

Provedores ao vivo no OpenRouter

Disponibilidade, latência, throughput e roteamento mudam continuamente. Consulte a fonte para dados atuais.

OpenRouter

Google AI Studio

Não informado
Contexto
262K
Saída máxima
33K
Entrada
Grátis
Saída
Grátis
Leitura de cache
Não informado
Gravação de cache
Não informado
google

4 modelos

Todos os modelos
google logogoogle

Google: Gemini 3.8 Flash

Gemini 3.8 Flash is Google's most intelligent Flash model with significant gains from 3.7 Flash across software engineering, agentic tasks, and multi-step reasoning.

Contexto
1.0M
Entrada
text · image · video · file · audio
Saída
text
Entrada: $0.75Saída: $3.75por milhão de tokens
Ver detalhes do modelo
google logogoogle

Google: Gemini 3.8 Flash (batch)

Gemini 3.8 Flash is Google's most intelligent Flash model with significant gains from 3.7 Flash across software engineering, agentic tasks, and multi-step reasoning.

Contexto
1.0M
Entrada
text · image · video · file · audio
Saída
text
Entrada: $0.375Saída: $1.875por milhão de tokens
Ver detalhes do modelo
google logogoogle

Google: Gemini 3.7 Flash

Gemini 3.7 Flash is a multimodal model from Google for fast agentic workflows, coding, and complex multi-step reasoning. It is designed for tasks that require responsive performance and reliable multi-step...

Contexto
1.0M
Entrada
text · image · video · file · audio
Saída
text
Entrada: $0.75Saída: $3.75por milhão de tokens
Ver detalhes do modelo
google logogoogle

Google: Gemini 3.7 Flash (batch)

Gemini 3.7 Flash is a multimodal model from Google for fast agentic workflows, coding, and complex multi-step reasoning. It is designed for tasks that require responsive performance and reliable multi-step...

Contexto
1.0M
Entrada
text · image · video · file · audio
Saída
text
Entrada: $0.375Saída: $1.875por milhão de tokens
Ver detalhes do modelo