z-ai logo
z-ai

Z.ai: GLM 5.2 (free)

Descrição da fonte (inglês)

GLM 5.2 is a large-scale reasoning model from Z.ai. It supports text input and output with a 1M-token context window, and is suited for long-horizon agent workflows, project-level software engineering,...

Visão geral

Especificações do modelo

Contexto
32.768 tokens
Saída máxima
29.491 tokens
Arquitetura
text->text
Tokenizador
Other
Limite de conhecimento
Não informado
Moderado
Não
OPENROUTER

Preços completos

Tarifas sincronizadas do OpenRouter, por milhão de tokens.

Entrada
Grátis
por milhão de tokens
Saída
Grátis
por milhão de tokens
API

Configuração do modelo

Parâmetros padrão

temperature
1
top_p
0.95

Raciocínio

Raciocínio obrigatório
Não
Parâmetros padrão
high
Recursos e modalidades
xhigh, high
API

Início rápido

Defina OPENROUTER_API_KEY localmente. Python requer requests; JavaScript roda em Node.js. Mantenha a chave no servidor.

Documentação da API

curl --fail-with-body https://openrouter.ai/api/v1/chat/completions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"z-ai/glm-5.2:free","messages":[{"role":"user","content":"Hello!"}]}'
Recursos e modalidades

EntradaSaída

Entrada
text
Saída
text
Raciocínio

Sim · xhigh · high

API

Parâmetros de API compatíveis

frequency_penaltyinclude_reasoningmax_tokensmin_ppresence_penaltyreasoningreasoning_effortrepetition_penaltyseedstoptemperaturetop_ktop_p
Provedores disponíveis

1 Provedor

Verificado: 16 de setembro de 2026

Provedores ao vivo no OpenRouter

Disponibilidade, latência, throughput e roteamento mudam continuamente. Consulte a fonte para dados atuais.

OpenRouter

Decart

fp4
Contexto
33K
Saída máxima
29K
Entrada
Grátis
Saída
Grátis
Leitura de cache
Não informado
Gravação de cache
Não informado
z-ai

4 modelos

Todos os modelos
z-ai logoz-ai

Z.ai: GLM 5.3 FlashX

GLM-5.3-FlashX is the high-speed variant of Z.ai's GLM-5.3-Flash, a native multimodal model delivering inference speeds of up to 200 tokens/s. Built on the same hybrid sparse and linear attention architecture...

Contexto
1.0M
Entrada
text · image · video
Saída
text
Entrada: $0.37Saída: $1.25por milhão de tokens
Ver detalhes do modelo
z-ai logoz-ai

Z.ai: GLM 5.3 Flash

GLM-5.3-Flash is a native multimodal model from Z.ai. It is suited for efficient coding and long-horizon agent tasks. Its hybrid sparse and linear attention architecture maintains accurate long-context behavior while...

Contexto
1.3M
Entrada
text · image · video
Saída
text
Entrada: $0.15Saída: $0.5por milhão de tokens
Ver detalhes do modelo
z-ai logoz-ai

Z.ai: GLM 5.3 Flash (batch)

GLM-5.3-Flash is a native multimodal model from Z.ai. It is suited for efficient coding and long-horizon agent tasks. Its hybrid sparse and linear attention architecture maintains accurate long-context behavior while...

Contexto
1.0M
Entrada
text · image · video
Saída
text
Entrada: $0.06Saída: $0.2por milhão de tokens
Ver detalhes do modelo
z-ai logoz-ai

Z.ai: GLM 5.3

GLM-5.3 is a large-scale reasoning model from Z.ai, built for complex software engineering and long-horizon agent tasks. It supports text input and output with a 1M-token context window, and improves...

Contexto
1.3M
Entrada
text
Saída
text
Entrada: $0.5614Saída: $1.7644por milhão de tokens
Ver detalhes do modelo