Caractéristiques du modèle
- Contexte
- 1 048 576 tokens
- Sortie maximale
- 943 718 tokens
- Architecture
- text->text
- Tokenizer
- Other
- Limite des connaissances
- Non indiqué
- Modéré
- Non
Tarification complète
Tarifs synchronisés depuis OpenRouter, par million de tokens.
- Entrée
- $0.7 par million de tokens
- Sortie
- $2.2 par million de tokens
- Lecture du cache
- $0.13 par million de tokens
Configuration du modèle
Paramètres par défaut
temperature- 1
top_p- 0.95
Raisonnement
- Raisonnement obligatoire
- Oui
- Paramètres par défaut
- max
- Capacités et modalités
- max, high, low
Démarrage rapide
Définissez OPENROUTER_API_KEY localement. Python nécessite requests ; JavaScript s’exécute dans Node.js. Gardez la clé côté serveur.
Cette requête soumet un lot asynchrone avec l’ID du modèle de base. L’ID de tâche confirme la soumission, pas la fin du traitement.
curl --fail-with-body https://openrouter.ai/api/beta/batches \
-H "Authorization: Bearer $OPENROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{"endpoint":"/v1/chat/completions","model":"z-ai/glm-5.3","requests":[{"custom_id":"request-1","body":{"messages":[{"role":"user","content":"Hello!"}]}}]}'
# Replace JOB_ID with the returned id to check progress.
curl --fail-with-body "https://openrouter.ai/api/beta/batches/JOB_ID" \
-H "Authorization: Bearer $OPENROUTER_API_KEY"Entrée → Sortie
Oui · max · high · low
Paramètres API pris en charge
frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokenspresence_penaltyreasoningreasoning_effortrepetition_penaltyresponse_formatstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p1 Fournisseur
Vérifié: 9 septembre 2026
Disponibilité, latence, débit et routage évoluent en continu. Consultez la source pour les données en temps réel.
Fireworks
Non indiqué- Contexte
- 1.0M
- Sortie maximale
- 944K
- Entrée
- $0.7
- Sortie
- $2.2
- Lecture du cache
- $0.13
- Écriture du cache
- Non indiqué