google logo
google

Google: Gemini 2.5 Flash Lite (batch)

Descrizione della fonte (inglese)

Gemini 2.5 Flash-Lite is a lightweight reasoning model in the Gemini 2.5 family, optimized for ultra-low latency and cost efficiency. It offers improved throughput, faster token generation, and better performance...

Panoramica

Specifiche del modello

Contesto
1.048.576 tokens
Output massimo
65.535 tokens
Architettura
text+image+file+audio+video->text
Tokenizer
Gemini
Limite di conoscenza
2025-01-31
Moderato
No
OPENROUTER

Prezzi completi

Tariffe sincronizzate da OpenRouter, per milione di token.

Input
$0.05
per milione di token
Output
$0.2
per milione di token
Lettura cache
$0.01
per milione di token
Input immagine
$0.05
per milione di token
Input audio
$0.15
per milione di token
Input Audio Cache
$0.03
per milione di token
API

Configurazione del modello

Ragionamento

Ragionamento obbligatorio
No
Parametri predefiniti
No
API

Avvio rapido

Imposta OPENROUTER_API_KEY localmente. Python richiede requests; JavaScript viene eseguito in Node.js. Conserva la chiave sul server.

Questa richiesta invia un batch asincrono con l’ID del modello base. L’ID dell’attività conferma l’invio, non il completamento.

Documentazione API

curl --fail-with-body https://openrouter.ai/api/beta/batches \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"endpoint":"/v1/chat/completions","model":"google/gemini-2.5-flash-lite","requests":[{"custom_id":"request-1","body":{"messages":[{"role":"user","content":"Hello!"}]}}]}'

# Replace JOB_ID with the returned id to check progress.
curl --fail-with-body "https://openrouter.ai/api/beta/batches/JOB_ID" \
  -H "Authorization: Bearer $OPENROUTER_API_KEY"
Capacità e modalità

InputOutput

Input
textimagefileaudiovideo
Output
text
Ragionamento

No

API

Parametri API supportati

include_reasoningmax_tokensreasoningresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_p
Provider disponibili

1 Provider

Verificato: 7 settembre 2026

Provider live su OpenRouter

Disponibilità, latenza, throughput e routing cambiano continuamente. Consulta la fonte per i dati correnti.

OpenRouter

Google

Non indicato
Contesto
1.0M
Output massimo
66K
Input
$0.05
Output
$0.2
Lettura cache
$0.01
Scrittura cache
Non indicato
google

4 modelli

Tutti i modelli
google logogoogle

Google: Gemini 3.8 Flash

Gemini 3.8 Flash is Google's most intelligent Flash model with significant gains from 3.7 Flash across software engineering, agentic tasks, and multi-step reasoning.

Contesto
1.0M
Input
text · image · video · file · audio
Output
text
Input: $0.75Output: $3.75per milione di token
Vedi i dettagli del modello
google logogoogle

Google: Gemini 3.8 Flash (batch)

Gemini 3.8 Flash is Google's most intelligent Flash model with significant gains from 3.7 Flash across software engineering, agentic tasks, and multi-step reasoning.

Contesto
1.0M
Input
text · image · video · file · audio
Output
text
Input: $0.375Output: $1.875per milione di token
Vedi i dettagli del modello
google logogoogle

Google: Gemini 3.7 Flash

Gemini 3.7 Flash is a multimodal model from Google for fast agentic workflows, coding, and complex multi-step reasoning. It is designed for tasks that require responsive performance and reliable multi-step...

Contesto
1.0M
Input
text · image · video · file · audio
Output
text
Input: $0.75Output: $3.75per milione di token
Vedi i dettagli del modello
google logogoogle

Google: Gemini 3.7 Flash (batch)

Gemini 3.7 Flash is a multimodal model from Google for fast agentic workflows, coding, and complex multi-step reasoning. It is designed for tasks that require responsive performance and reliable multi-step...

Contesto
1.0M
Input
text · image · video · file · audio
Output
text
Input: $0.375Output: $1.875per milione di token
Vedi i dettagli del modello