google logo
google

Google: Gemini 3.1 Flash Lite (batch)

Descrizione della fonte (inglese)

Gemini 3.1 Flash Lite is Google’s GA high-efficiency multimodal model optimized for low-latency, high-volume workloads. It supports text, image, video, audio, and PDF inputs, and is designed for lightweight agentic...

Panoramica

Specifiche del modello

Contesto
1.048.576 tokens
Output massimo
65.536 tokens
Architettura
text+image+file+audio+video->text
Tokenizer
Gemini
Limite di conoscenza
Non indicato
Moderato
No
OPENROUTER

Prezzi completi

Tariffe sincronizzate da OpenRouter, per milione di token.

Input
$0.125
per milione di token
Output
$0.75
per milione di token
Lettura cache
$0.0125
per milione di token
Input immagine
$0.125
per milione di token
Input audio
$0.25
per milione di token
Input Audio Cache
$0.025
per milione di token
Ricerca web
$14
per 1.000 chiamate
API

Configurazione del modello

Ragionamento

Ragionamento obbligatorio
No
Parametri predefiniti
minimal
Capacità e modalità
high, medium, low, minimal
API

Avvio rapido

Imposta OPENROUTER_API_KEY localmente. Python richiede requests; JavaScript viene eseguito in Node.js. Conserva la chiave sul server.

Questa richiesta invia un batch asincrono con l’ID del modello base. L’ID dell’attività conferma l’invio, non il completamento.

Documentazione API

curl --fail-with-body https://openrouter.ai/api/beta/batches \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"endpoint":"/v1/chat/completions","model":"google/gemini-3.1-flash-lite","requests":[{"custom_id":"request-1","body":{"messages":[{"role":"user","content":"Hello!"}]}}]}'

# Replace JOB_ID with the returned id to check progress.
curl --fail-with-body "https://openrouter.ai/api/beta/batches/JOB_ID" \
  -H "Authorization: Bearer $OPENROUTER_API_KEY"
Capacità e modalità

InputOutput

Input
textimagevideofileaudio
Output
text
Ragionamento

· high · medium · low · minimal

API

Parametri API supportati

include_reasoningmax_tokensreasoningreasoning_effortresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_p
Provider disponibili

1 Provider

Verificato: 7 settembre 2026

Provider live su OpenRouter

Disponibilità, latenza, throughput e routing cambiano continuamente. Consulta la fonte per i dati correnti.

OpenRouter

Google

Non indicato
Contesto
1.0M
Output massimo
66K
Input
$0.125
Output
$0.75
Lettura cache
$0.0125
Scrittura cache
Non indicato
google

4 modelli

Tutti i modelli
google logogoogle

Google: Gemini 3.8 Flash

Gemini 3.8 Flash is Google's most intelligent Flash model with significant gains from 3.7 Flash across software engineering, agentic tasks, and multi-step reasoning.

Contesto
1.0M
Input
text · image · video · file · audio
Output
text
Input: $0.75Output: $3.75per milione di token
Vedi i dettagli del modello
google logogoogle

Google: Gemini 3.8 Flash (batch)

Gemini 3.8 Flash is Google's most intelligent Flash model with significant gains from 3.7 Flash across software engineering, agentic tasks, and multi-step reasoning.

Contesto
1.0M
Input
text · image · video · file · audio
Output
text
Input: $0.375Output: $1.875per milione di token
Vedi i dettagli del modello
google logogoogle

Google: Gemini 3.7 Flash

Gemini 3.7 Flash is a multimodal model from Google for fast agentic workflows, coding, and complex multi-step reasoning. It is designed for tasks that require responsive performance and reliable multi-step...

Contesto
1.0M
Input
text · image · video · file · audio
Output
text
Input: $0.75Output: $3.75per milione di token
Vedi i dettagli del modello
google logogoogle

Google: Gemini 3.7 Flash (batch)

Gemini 3.7 Flash is a multimodal model from Google for fast agentic workflows, coding, and complex multi-step reasoning. It is designed for tasks that require responsive performance and reliable multi-step...

Contesto
1.0M
Input
text · image · video · file · audio
Output
text
Input: $0.375Output: $1.875per milione di token
Vedi i dettagli del modello