z-ai logo
z-ai

Z.ai: GLM 5.3 FlashX

Description de la source (anglais)

GLM-5.3-FlashX is the high-speed variant of Z.ai's GLM-5.3-Flash, a native multimodal model delivering inference speeds of up to 200 tokens/s. Built on the same hybrid sparse and linear attention architecture...

Présentation

Caractéristiques du modèle

Contexte
1 048 576 tokens
Sortie maximale
131 072 tokens
Architecture
text+image+video->text
Tokenizer
Other
Limite des connaissances
Non indiqué
Modéré
Non
OPENROUTER

Tarification complète

Tarifs synchronisés depuis OpenRouter, par million de tokens.

Entrée
$0.37
par million de tokens
Sortie
$1.25
par million de tokens
Lecture du cache
$0.075
par million de tokens
API

Configuration du modèle

Paramètres par défaut

temperature
1
top_p
0.95

Raisonnement

Raisonnement obligatoire
Oui
Paramètres par défaut
max
Capacités et modalités
max, high, low
API

Démarrage rapide

Définissez OPENROUTER_API_KEY localement. Python nécessite requests ; JavaScript s’exécute dans Node.js. Gardez la clé côté serveur.

Documentation de l’API

curl --fail-with-body https://openrouter.ai/api/v1/chat/completions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"z-ai/glm-5.3-flashx","messages":[{"role":"user","content":"Hello!"}]}'
Capacités et modalités

EntréeSortie

Entrée
textimagevideo
Sortie
text
Raisonnement

Oui · max · high · low

API

Paramètres API pris en charge

include_reasoningmax_tokensreasoningreasoning_effortresponse_formattemperaturetool_choicetoolstop_ktop_p
Fournisseurs disponibles

1 Fournisseur

Vérifié: 19 septembre 2026

Fournisseurs en direct sur OpenRouter

Disponibilité, latence, débit et routage évoluent en continu. Consultez la source pour les données en temps réel.

OpenRouter

Z.AI

fp8
Contexte
1.0M
Sortie maximale
131K
Entrée
$0.37
Sortie
$1.25
Lecture du cache
$0.075
Écriture du cache
Non indiqué
z-ai

4 modèles

Tous les modèles