google logo
google

Google: Gemini 3.1 Flash Lite

Gemini 3.1 Flash Lite is Google’s GA high-efficiency multimodal model optimized for low-latency, high-volume workloads. $0.25 per million input tokens, $1.50 per million output tokens. 1,048,576 token context window, maximum output of 65,536 tokens. Higher uptime with 2 providers.

Visão geral

Especificações do modelo

Contexto
1.048.576 tokens
Saída máxima
65.536 tokens
Arquitetura
text+image+file+audio+video->text
Tokenizador
Gemini
Limite de conhecimento
Não informado
Moderado
Não
OPENROUTER

Preços completos

Tarifas sincronizadas do OpenRouter, por milhão de tokens.

Entrada
$0.25
/M tokens
Saída
$1.5
/M tokens
Leitura de cache
$0.025
/M tokens
Gravação de cache
$0.0833
/M tokens
Image Input
$0.25
/M tokens
Input Audio
$0.5
/M tokens
Input Audio Cache
$0.05
/M tokens
Pesquisa web
$14
/1K calls
API

Configuração do modelo

Raciocínio

Moderado
Não
Parâmetros padrão
minimal
Recursos e modalidades
high, medium, low, minimal
API

Início rápido

Use este modelo pela API compatível com OpenAI do OpenRouter.

curl https://openrouter.ai/api/v1/chat/completions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"google/gemini-3.1-flash-lite","messages":[{"role":"user","content":"Hello!"}]}'
Recursos e modalidades

EntradaSaída

Entrada
textimagevideofileaudio
Saída
text
Raciocínio

Sim · high · medium · low · minimal

API

Parâmetros de API compatíveis

include_reasoningmax_tokensreasoningreasoning_effortresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_p
Provedores disponíveis

8 provedores

Provedores ao vivo no OpenRouter

Disponibilidade, latência, throughput e roteamento mudam continuamente. Consulte a fonte para dados atuais.

OpenRouter

Google

unknown
Contexto
1.0M
Saída máxima
66K
Entrada
$0.250
Saída
$1.50
Leitura de cache
$0.025
Gravação de cache
$0.083

Google

unknown
Contexto
1.0M
Saída máxima
66K
Entrada
$0.125
Saída
$0.750
Leitura de cache
$0.012
Gravação de cache
$0.042

Google

unknown
Contexto
1.0M
Saída máxima
66K
Entrada
$0.450
Saída
$2.70
Leitura de cache
$0.045
Gravação de cache
$0.150

Google AI Studio

unknown
Contexto
1.0M
Saída máxima
66K
Entrada
$0.250
Saída
$1.50
Leitura de cache
$0.025
Gravação de cache
$0.083

Google AI Studio

unknown
Contexto
1.0M
Saída máxima
66K
Entrada
$0.125
Saída
$0.750
Leitura de cache
$0.012
Gravação de cache
$0.042

Google AI Studio

unknown
Contexto
1.0M
Saída máxima
66K
Entrada
$0.450
Saída
$2.70
Leitura de cache
$0.045
Gravação de cache
$0.150

Google

unknown
Contexto
1.0M
Saída máxima
66K
Entrada
$0.275
Saída
$1.65
Leitura de cache
$0.028
Gravação de cache
$0.083

Google

unknown
Contexto
1.0M
Saída máxima
66K
Entrada
$0.275
Saída
$1.65
Leitura de cache
$0.028
Gravação de cache
$0.083
google

modelos

Todos os modelos
google logogoogle

Google: Gemini 3.7 Flash

Gemini 3.7 Flash is a multimodal model from Google for fast agentic workflows, coding, and complex multi-step reasoning. It is designed for tasks that require responsive performance and reliable multi-step...

Contexto
1.0M
Entrada
text · image · video · file · audio
Saída
text
Entrada: $0.750Saída: $3.75por milhão de tokens
Ver detalhes do modelo
google logogoogle

Google: Gemini 3.7 Flash (batch)

Gemini 3.7 Flash is a multimodal model from Google for fast agentic workflows, coding, and complex multi-step reasoning. It is designed for tasks that require responsive performance and reliable multi-step...

Contexto
1.0M
Entrada
text · image · video · file · audio
Saída
text
Entrada: $0.188Saída: $0.938por milhão de tokens
Ver detalhes do modelo
google logogoogle

Google: Gemini 3.6 Flash

Gemini 3.6 Flash is a high-efficiency model from Google for coding, agentic workflows, and web and app development. It is designed to produce polished outputs with fewer unnecessary edits and...

Contexto
1.0M
Entrada
text · image · video · file · audio
Saída
text
Entrada: $0.750Saída: $3.75por milhão de tokens
Ver detalhes do modelo
google logogoogle

Google: Gemini 3.6 Flash (batch)

Gemini 3.6 Flash is a high-efficiency model from Google for coding, agentic workflows, and web and app development. It is designed to produce polished outputs with fewer unnecessary edits and...

Contexto
1.0M
Entrada
text · image · video · file · audio
Saída
text
Entrada: $0.375Saída: $1.88por milhão de tokens
Ver detalhes do modelo