google logo
google

Google: Gemini 2.5 Flash Lite (batch)

Description de la source (anglais)

Gemini 2.5 Flash-Lite is a lightweight reasoning model in the Gemini 2.5 family, optimized for ultra-low latency and cost efficiency. It offers improved throughput, faster token generation, and better performance...

Présentation

Caractéristiques du modèle

Contexte
1 048 576 tokens
Sortie maximale
65 535 tokens
Architecture
text+image+file+audio+video->text
Tokenizer
Gemini
Limite des connaissances
2025-01-31
Modéré
Non
OPENROUTER

Tarification complète

Tarifs synchronisés depuis OpenRouter, par million de tokens.

Entrée
$0.05
par million de tokens
Sortie
$0.2
par million de tokens
Lecture du cache
$0.01
par million de tokens
Image en entrée
$0.05
par million de tokens
Audio en entrée
$0.15
par million de tokens
Input Audio Cache
$0.03
par million de tokens
API

Configuration du modèle

Raisonnement

Raisonnement obligatoire
Non
Paramètres par défaut
Non
API

Démarrage rapide

Définissez OPENROUTER_API_KEY localement. Python nécessite requests ; JavaScript s’exécute dans Node.js. Gardez la clé côté serveur.

Cette requête soumet un lot asynchrone avec l’ID du modèle de base. L’ID de tâche confirme la soumission, pas la fin du traitement.

Documentation de l’API

curl --fail-with-body https://openrouter.ai/api/beta/batches \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"endpoint":"/v1/chat/completions","model":"google/gemini-2.5-flash-lite","requests":[{"custom_id":"request-1","body":{"messages":[{"role":"user","content":"Hello!"}]}}]}'

# Replace JOB_ID with the returned id to check progress.
curl --fail-with-body "https://openrouter.ai/api/beta/batches/JOB_ID" \
  -H "Authorization: Bearer $OPENROUTER_API_KEY"
Capacités et modalités

EntréeSortie

Entrée
textimagefileaudiovideo
Sortie
text
Raisonnement

Non

API

Paramètres API pris en charge

include_reasoningmax_tokensreasoningresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_p
Fournisseurs disponibles

1 Fournisseur

Vérifié: 7 septembre 2026

Fournisseurs en direct sur OpenRouter

Disponibilité, latence, débit et routage évoluent en continu. Consultez la source pour les données en temps réel.

OpenRouter

Google

Non indiqué
Contexte
1.0M
Sortie maximale
66K
Entrée
$0.05
Sortie
$0.2
Lecture du cache
$0.01
Écriture du cache
Non indiqué
google

4 modèles

Tous les modèles
google logogoogle

Google: Gemini 3.8 Flash

Gemini 3.8 Flash is Google's most intelligent Flash model with significant gains from 3.7 Flash across software engineering, agentic tasks, and multi-step reasoning.

Contexte
1.0M
Entrée
text · image · video · file · audio
Sortie
text
Entrée: $0.75Sortie: $3.75par million de tokens
Voir la fiche du modèle
google logogoogle

Google: Gemini 3.8 Flash (batch)

Gemini 3.8 Flash is Google's most intelligent Flash model with significant gains from 3.7 Flash across software engineering, agentic tasks, and multi-step reasoning.

Contexte
1.0M
Entrée
text · image · video · file · audio
Sortie
text
Entrée: $0.375Sortie: $1.875par million de tokens
Voir la fiche du modèle
google logogoogle

Google: Gemini 3.7 Flash

Gemini 3.7 Flash is a multimodal model from Google for fast agentic workflows, coding, and complex multi-step reasoning. It is designed for tasks that require responsive performance and reliable multi-step...

Contexte
1.0M
Entrée
text · image · video · file · audio
Sortie
text
Entrée: $0.75Sortie: $3.75par million de tokens
Voir la fiche du modèle
google logogoogle

Google: Gemini 3.7 Flash (batch)

Gemini 3.7 Flash is a multimodal model from Google for fast agentic workflows, coding, and complex multi-step reasoning. It is designed for tasks that require responsive performance and reliable multi-step...

Contexte
1.0M
Entrée
text · image · video · file · audio
Sortie
text
Entrée: $0.375Sortie: $1.875par million de tokens
Voir la fiche du modèle