z-ai logo
z-ai

Z.ai: GLM 5.1

GLM-5.1 delivers a major leap in coding capability, with particularly significant gains in handling long-horizon tasks. $0.91 per million input tokens, $2.86 per million output tokens. 204,800 token context window. Higher uptime with 17 providers. Includes independent benchmarks from Artificial Analysis.

Panoramica

Specifiche del modello

Contesto
204.800 tokens
Output massimo
128.000 tokens
Architettura
text->text
Tokenizer
Other
Limite di conoscenza
Non indicato
Moderato
No
OPENROUTER

Prezzi completi

Tariffe sincronizzate da OpenRouter, per milione di token.

Input
$0.91
/M tokens
Output
$2.86
/M tokens
Lettura cache
$0.169
/M tokens
API

Configurazione del modello

Parametri predefiniti

temperature
1
top_p
0.95

Ragionamento

Moderato
No
Parametri predefiniti
API

Avvio rapido

Chiama questo modello tramite l’API compatibile OpenAI di OpenRouter.

curl https://openrouter.ai/api/v1/chat/completions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"z-ai/glm-5.1","messages":[{"role":"user","content":"Hello!"}]}'
Capacità e modalità

InputOutput

Input
text
Output
text
Ragionamento

API

Parametri API supportati

frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokensmin_ppresence_penaltyreasoningrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p
Provider disponibili

17 provider

Provider live su OpenRouter

Disponibilità, latenza, throughput e routing cambiano continuamente. Consulta la fonte per i dati correnti.

OpenRouter

GMICloud

fp8
Contesto
203K
Output massimo
182K
Input
$0.910
Output
$2.86
Lettura cache
$0.169
Scrittura cache
Non indicato

StreamLake

fp8
Contesto
200K
Output massimo
128K
Input
$0.966
Output
$3.04
Lettura cache
$0.179
Scrittura cache
Non indicato

Chutes

fp8
Contesto
203K
Output massimo
66K
Input
$0.980
Output
$3.08
Lettura cache
$0.098
Scrittura cache
Non indicato

DeepInfra

fp4
Contesto
203K
Output massimo
66K
Input
$1.05
Output
$3.50
Lettura cache
$0.205
Scrittura cache
Non indicato

SiliconFlow

fp8
Contesto
205K
Output massimo
131K
Input
$1.19
Output
$3.74
Lettura cache
$0.600
Scrittura cache
Non indicato

Crusoe

fp8
Contesto
203K
Output massimo
182K
Input
$1.20
Output
$4.40
Lettura cache
$0.250
Scrittura cache
Non indicato

Phala

unknown
Contesto
203K
Output massimo
128K
Input
$1.21
Output
$4.20
Lettura cache
$0.600
Scrittura cache
Non indicato

AtlasCloud

fp8
Contesto
203K
Output massimo
182K
Input
$1.26
Output
$3.96
Lettura cache
$0.234
Scrittura cache
Non indicato

DigitalOcean

unknown
Contesto
164K
Output massimo
147K
Input
$1.30
Output
$4.30
Lettura cache
$0.260
Scrittura cache
Non indicato

Alibaba

fp8
Contesto
203K
Output massimo
131K
Input
$1.33
Output
$4.18
Lettura cache
$0.247
Scrittura cache
Non indicato

Novita

fp8
Contesto
205K
Output massimo
131K
Input
$1.38
Output
$4.40
Lettura cache
$0.260
Scrittura cache
Non indicato

Baidu

fp8
Contesto
203K
Output massimo
131K
Input
$1.40
Output
$4.40
Lettura cache
$0.260
Scrittura cache
Non indicato

Nebius

fp8
Contesto
203K
Output massimo
182K
Input
$1.40
Output
$4.40
Lettura cache
Non indicato
Scrittura cache
Non indicato

Z.AI

fp8
Contesto
203K
Output massimo
131K
Input
$1.40
Output
$4.40
Lettura cache
$0.260
Scrittura cache
Non indicato

Parasail

fp8
Contesto
203K
Output massimo
131K
Input
$1.40
Output
$4.40
Lettura cache
$0.260
Scrittura cache
Non indicato

Friendli

unknown
Contesto
203K
Output massimo
182K
Input
$1.40
Output
$4.40
Lettura cache
$0.260
Scrittura cache
Non indicato

Venice

fp8
Contesto
200K
Output massimo
80K
Input
$1.54
Output
$4.84
Lettura cache
$0.286
Scrittura cache
Non indicato
z-ai

modelli

Tutti i modelli
z-ai logoz-ai

Z.ai: GLM 5.3 Flash (batch)

GLM-5.3-Flash is a native multimodal model from Z.ai. It is suited for efficient coding and long-horizon agent tasks. Its hybrid sparse and linear attention architecture maintains accurate long-context behavior while...

Contesto
1.0M
Input
text · image · video
Output
text
Input: $0.150Output: $0.500per milione di token
Vedi i dettagli del modello
z-ai logoz-ai

Z.ai: GLM 5.2

GLM 5.2 is a large-scale reasoning model from Z.ai. It supports text input and output with a 1M-token context window, and is suited for long-horizon agent workflows, project-level software engineering,...

Contesto
1.0M
Input
text
Output
text
Input: $1.19Output: $3.74per milione di token
Vedi i dettagli del modello
z-ai logoz-ai

Z.ai: GLM 5.2 (free)

GLM 5.2 is a large-scale reasoning model from Z.ai. It supports text input and output with a 1M-token context window, and is suited for long-horizon agent workflows, project-level software engineering,...

Contesto
256K
Input
text
Output
text
Input: GratuitoOutput: Gratuitoper milione di token
Vedi i dettagli del modello
z-ai logoz-ai

Z.ai: GLM 5

GLM-5 is Z.ai’s flagship open-source foundation model engineered for complex systems design and long-horizon agent workflows. Built for expert developers, it delivers production-grade performance on large-scale programming tasks, rivaling leading...

Contesto
205K
Input
text
Output
text
Input: $0.600Output: $1.92per milione di token
Vedi i dettagli del modello