z-ai logo
z-ai

Z.ai: GLM 4.5 Air

GLM-4.5-Air is the lightweight variant of our latest flagship model family, also purpose-built for agent-centric applications. $0.13 per million input tokens, $0.85 per million output tokens. 131,072 token context window, maximum output of 98,304 tokens. Higher uptime with 3 providers. Includes independent benchmarks from Artificial Analysis.

Resumen

Especificaciones del modelo

Contexto
131.072 tokens
Salida máxima
98.304 tokens
Arquitectura
text->text
Tokenizador
Other
Corte de conocimiento
2024-12-31
Moderado
No
OPENROUTER

Precios completos

Tarifas sincronizadas desde OpenRouter, por millón de tokens.

Entrada
$0.13
/M tokens
Salida
$0.85
/M tokens
Lectura de caché
$0.025
/M tokens
API

Configuración del modelo

Parámetros predeterminados

temperature
0.75

Razonamiento

Moderado
No
Parámetros predeterminados
No
API

Inicio rápido

Usa este modelo mediante la API compatible con OpenAI de OpenRouter.

curl https://openrouter.ai/api/v1/chat/completions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"z-ai/glm-4.5-air","messages":[{"role":"user","content":"Hello!"}]}'
Capacidades y modalidades

EntradaSalida

Entrada
text
Salida
text
Razonamiento

No

API

Parámetros API compatibles

frequency_penaltyinclude_reasoningmax_tokenspresence_penaltyreasoningrepetition_penaltyseedstoptemperaturetool_choicetoolstop_ktop_p
Proveedores disponibles

3 proveedores

Proveedores en vivo en OpenRouter

Disponibilidad, latencia, rendimiento y enrutamiento cambian continuamente. Consulta la fuente para datos actuales.

OpenRouter

Novita

bf16
Contexto
131K
Salida máxima
98K
Entrada
$0.130
Salida
$0.850
Lectura de caché
$0.025
Escritura de caché
No indicado

SiliconFlow

fp8
Contexto
131K
Salida máxima
118K
Entrada
$0.140
Salida
$0.860
Lectura de caché
No indicado
Escritura de caché
No indicado

Z.AI

fp8
Contexto
131K
Salida máxima
98K
Entrada
$0.200
Salida
$1.10
Lectura de caché
$0.030
Escritura de caché
No indicado