z-ai logo
z-ai

Z.ai: GLM 5.3

Description de la source (anglais)

GLM-5.3 is a large-scale reasoning model from Z.ai, built for complex software engineering and long-horizon agent tasks. It supports text input and output with a 1M-token context window, and improves...

Présentation

Caractéristiques du modèle

Contexte
1 310 720 tokens
Sortie maximale
943 717 tokens
Architecture
text->text
Tokenizer
Other
Limite des connaissances
Non indiqué
Modéré
Non
OPENROUTER

Tarification complète

Tarifs synchronisés depuis OpenRouter, par million de tokens.

Entrée
$1.4
par million de tokens
Sortie
$4.4
par million de tokens
Lecture du cache
$0.26
par million de tokens
API

Configuration du modèle

Paramètres par défaut

temperature
1
top_p
0.95

Raisonnement

Raisonnement obligatoire
Oui
Paramètres par défaut
max
Capacités et modalités
max, high, low
API

Démarrage rapide

Définissez OPENROUTER_API_KEY localement. Python nécessite requests ; JavaScript s’exécute dans Node.js. Gardez la clé côté serveur.

Documentation de l’API

curl --fail-with-body https://openrouter.ai/api/v1/chat/completions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"z-ai/glm-5.3","messages":[{"role":"user","content":"Hello!"}]}'
Capacités et modalités

Entrée → Sortie

Entrée
text
Sortie
text
Raisonnement

Oui · max · high · low

API

Paramètres API pris en charge

frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokensmin_pparallel_tool_callspresence_penaltyreasoningreasoning_effortrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p
Fournisseurs disponibles

40 fournisseurs

Vérifié: 28 septembre 2026

Fournisseurs en direct sur OpenRouter

Disponibilité, latence, débit et routage évoluent en continu. Consultez la source pour les données en temps réel.

OpenRouter

Reka

Non indiqué
Contexte
262K
Sortie maximale
236K
Entrée
$0.3556
Sortie
$2.574
Lecture du cache
$0.066
Écriture du cache
Non indiqué

Inceptron

fp4
Contexte
1.0M
Sortie maximale
944K
Entrée
$0.4204
Sortie
$2.7392
Lecture du cache
$0.0967
Écriture du cache
Non indiqué

Morph

fp8
Contexte
1.0M
Sortie maximale
944K
Entrée
$0.4522
Sortie
$2.805
Lecture du cache
$0.1466
Écriture du cache
Non indiqué

Io Net

fp8
Contexte
262K
Sortie maximale
66K
Entrée
$0.5005
Sortie
$1.898
Lecture du cache
$0.091
Écriture du cache
Non indiqué

Relace

Non indiqué
Contexte
1.0M
Sortie maximale
131K
Entrée
$0.55
Sortie
$1.7
Lecture du cache
$0.1
Écriture du cache
Non indiqué

DeepInfra

fp4
Contexte
1.0M
Sortie maximale
131K
Entrée
$0.5625
Sortie
$2.5
Lecture du cache
$0.125
Écriture du cache
Non indiqué

InferenceNet

Non indiqué
Contexte
1.0M
Sortie maximale
131K
Entrée
$0.684
Sortie
$2.28
Lecture du cache
$0.114
Écriture du cache
Non indiqué

Sail Research

fp8
Contexte
1.0M
Sortie maximale
944K
Entrée
$0.77
Sortie
$4
Lecture du cache
$0.19
Écriture du cache
Non indiqué

Sail Research

fp8
Contexte
1.0M
Sortie maximale
944K
Entrée
$0.77
Sortie
$4
Lecture du cache
$0.19
Écriture du cache
Non indiqué

Novita

fp8
Contexte
1.0M
Sortie maximale
131K
Entrée
$0.7826
Sortie
$2.4596
Lecture du cache
$0.1453
Écriture du cache
Non indiqué

DigitalOcean

Non indiqué
Contexte
1.0M
Sortie maximale
128K
Entrée
$0.91
Sortie
$2.86
Lecture du cache
$0.169
Écriture du cache
Non indiqué

Phala

Non indiqué
Contexte
1.0M
Sortie maximale
131K
Entrée
$0.98
Sortie
$3.08
Lecture du cache
$0.182
Écriture du cache
Non indiqué

GMICloud

fp8
Contexte
1.0M
Sortie maximale
944K
Entrée
$0.98
Sortie
$3.08
Lecture du cache
$0.182
Écriture du cache
Non indiqué

Makora

fp4
Contexte
980K
Sortie maximale
128K
Entrée
$1.05
Sortie
$4.2
Lecture du cache
$0.19
Écriture du cache
Non indiqué

SiliconFlow

fp8
Contexte
1.0M
Sortie maximale
262K
Entrée
$1.12
Sortie
$3.52
Lecture du cache
$0.208
Écriture du cache
Non indiqué

Alibaba

Non indiqué
Contexte
1M
Sortie maximale
131K
Entrée
$1.19
Sortie
$3.74
Lecture du cache
$0.238
Écriture du cache
Non indiqué

Decart

fp4
Contexte
1.0M
Sortie maximale
944K
Entrée
$1.19
Sortie
$3.74
Lecture du cache
$0.1955
Écriture du cache
Non indiqué

Friendli

Non indiqué
Contexte
1.0M
Sortie maximale
944K
Entrée
$1.26
Sortie
$3.96
Lecture du cache
$0.234
Écriture du cache
Non indiqué

AkashML

fp8
Contexte
1.0M
Sortie maximale
131K
Entrée
$1.3
Sortie
$4.4
Lecture du cache
$0.26
Écriture du cache
Non indiqué

Mistral

nvfp4
Contexte
1.0M
Sortie maximale
131K
Entrée
$1.4
Sortie
$4.4
Lecture du cache
$0.14
Écriture du cache
Non indiqué

Wafer

Non indiqué
Contexte
1.0M
Sortie maximale
944K
Entrée
$1.4
Sortie
$4.4
Lecture du cache
$0.26
Écriture du cache
Non indiqué

Baidu

fp8
Contexte
1.0M
Sortie maximale
131K
Entrée
$1.4
Sortie
$4.4
Lecture du cache
$0.26
Écriture du cache
Non indiqué

BaseTen

fp4
Contexte
1.0M
Sortie maximale
262K
Entrée
$1.4
Sortie
$4.4
Lecture du cache
$0.14
Écriture du cache
Non indiqué

Mistral

nvfp4
Contexte
1.0M
Sortie maximale
131K
Entrée
$1.4
Sortie
$4.4
Lecture du cache
$0.14
Écriture du cache
Non indiqué

Crusoe

fp4
Contexte
1.0M
Sortie maximale
944K
Entrée
$1.4
Sortie
$4.4
Lecture du cache
$0.26
Écriture du cache
Non indiqué

PrimeIntellect

Non indiqué
Contexte
1.0M
Sortie maximale
131K
Entrée
$1.4
Sortie
$4.4
Lecture du cache
$0.26
Écriture du cache
Non indiqué

Venice

Non indiqué
Contexte
1M
Sortie maximale
131K
Entrée
$1.4
Sortie
$4.4
Lecture du cache
$0.26
Écriture du cache
Non indiqué

Together

Non indiqué
Contexte
1.0M
Sortie maximale
944K
Entrée
$1.4
Sortie
$4.4
Lecture du cache
$0.26
Écriture du cache
Non indiqué

Parasail

fp8
Contexte
1.0M
Sortie maximale
944K
Entrée
$1.4
Sortie
$4.4
Lecture du cache
$0.26
Écriture du cache
Non indiqué

Modal

Non indiqué
Contexte
1.0M
Sortie maximale
944K
Entrée
$1.4
Sortie
$4.4
Lecture du cache
$0.26
Écriture du cache
Non indiqué

BaseTen

fp4
Contexte
1.0M
Sortie maximale
262K
Entrée
$1.4
Sortie
$4.4
Lecture du cache
$0.14
Écriture du cache
Non indiqué

Fireworks

Non indiqué
Contexte
1.0M
Sortie maximale
944K
Entrée
$1.4
Sortie
$4.4
Lecture du cache
$0.26
Écriture du cache
Non indiqué

Cloudflare

Non indiqué
Contexte
1.3M
Sortie maximale
1.2M
Entrée
$1.4
Sortie
$4.4
Lecture du cache
$0.26
Écriture du cache
Non indiqué

AtlasCloud

fp8
Contexte
1.0M
Sortie maximale
131K
Entrée
$1.4
Sortie
$4.4
Lecture du cache
$0.26
Écriture du cache
Non indiqué

Z.AI

fp8
Contexte
1.0M
Sortie maximale
131K
Entrée
$1.4
Sortie
$4.4
Lecture du cache
$0.26
Écriture du cache
Non indiqué

Mistral

nvfp4
Contexte
1.0M
Sortie maximale
131K
Entrée
$1.54
Sortie
$4.84
Lecture du cache
$0.154
Écriture du cache
Non indiqué

Wafer

Non indiqué
Contexte
1.0M
Sortie maximale
944K
Entrée
$1.82
Sortie
$4.4
Lecture du cache
$0.26
Écriture du cache
Non indiqué

BaseTen

fp8
Contexte
1.0M
Sortie maximale
262K
Entrée
$2.1
Sortie
$6.6
Lecture du cache
$0.21
Écriture du cache
Non indiqué

BaseTen

fp8
Contexte
1.0M
Sortie maximale
262K
Entrée
$2.1
Sortie
$6.6
Lecture du cache
$0.21
Écriture du cache
Non indiqué

Alibaba

Non indiqué
Contexte
1M
Sortie maximale
131K
Entrée
$2.8
Sortie
$8.8
Lecture du cache
$0.56
Écriture du cache
Non indiqué
z-ai

4 modèles

Tous les modèles
z-ai logoz-ai

Z.ai: GLM 5.3 Prime

GLM-5.3-Prime is the high-speed variant of Z.ai's GLM-5.3, inheriting its full capabilities while delivering 1.5–2× the output throughput through inference acceleration. It supports text input and output with a 1M-token...

Contexte
1M
Entrée
text
Sortie
text
Entrée: $2.8Sortie: $8.8par million de tokens
Voir la fiche du modèle →
z-ai logoz-ai

Z.ai: GLM 5.3 FlashX

GLM-5.3-FlashX is the high-speed variant of Z.ai's GLM-5.3-Flash, a native multimodal model delivering inference speeds of up to 200 tokens/s. Built on the same hybrid sparse and linear attention architecture...

Contexte
1.0M
Entrée
text · image · video
Sortie
text
Entrée: $0.37Sortie: $1.25par million de tokens
Voir la fiche du modèle →
z-ai logoz-ai

Z.ai: GLM 5.3 Flash

GLM-5.3-Flash is a native multimodal model from Z.ai. It is suited for efficient coding and long-horizon agent tasks. Its hybrid sparse and linear attention architecture maintains accurate long-context behavior while...

Contexte
1.3M
Entrée
text · image · video
Sortie
text
Entrée: $0.15Sortie: $0.5par million de tokens
Voir la fiche du modèle →
z-ai logoz-ai

Z.ai: GLM 5.3 Flash (batch)

GLM-5.3-Flash is a native multimodal model from Z.ai. It is suited for efficient coding and long-horizon agent tasks. Its hybrid sparse and linear attention architecture maintains accurate long-context behavior while...

Contexte
1.0M
Entrée
text · image · video
Sortie
text
Entrée: $0.06Sortie: $0.2par million de tokens
Voir la fiche du modèle →