z-ai logo
z-ai

Z.ai: GLM 4.6

Descripción de la fuente (inglés)

Compared with GLM-4.5, this generation brings several key improvements: Longer context window: The context window has been expanded from 128K to 200K tokens, enabling the model to handle more complex...

Resumen

Especificaciones del modelo

Contexto
204.800 tokens
Salida máxima
16.384 tokens
Arquitectura
text->text
Tokenizador
Other
Corte de conocimiento
2025-03-31
Moderado
No
OPENROUTER

Precios completos

Tarifas sincronizadas desde OpenRouter, por millón de tokens.

Entrada
$0.43
por millón de tokens
Salida
$1.75
por millón de tokens
Lectura de caché
$0.08
por millón de tokens
API

Configuración del modelo

Parámetros predeterminados

temperature
0.6

Razonamiento

Razonamiento obligatorio
No
Parámetros predeterminados
No
API

Inicio rápido

Configura OPENROUTER_API_KEY localmente. Python requiere requests; JavaScript se ejecuta en Node.js. Mantén la clave en el servidor.

Documentación de la API

curl --fail-with-body https://openrouter.ai/api/v1/chat/completions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"z-ai/glm-4.6","messages":[{"role":"user","content":"Hello!"}]}'
Capacidades y modalidades

EntradaSalida

Entrada
text
Salida
text
Razonamiento

No

API

Parámetros API compatibles

frequency_penaltyinclude_reasoninglogit_biasmax_tokensmin_ppresence_penaltyreasoningrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_p
Proveedores disponibles

4 proveedores

Verificado: 20 de septiembre de 2026

Proveedores en vivo en OpenRouter

Disponibilidad, latencia, rendimiento y enrutamiento cambian continuamente. Consulta la fuente para datos actuales.

OpenRouter

Venice

fp4
Contexto
198K
Salida máxima
16K
Entrada
$0.43
Salida
$1.75
Lectura de caché
$0.08
Escritura de caché
No indicado

DeepInfra

fp4
Contexto
203K
Salida máxima
131K
Entrada
$0.5
Salida
$2
Lectura de caché
$0.1
Escritura de caché
No indicado

Novita

bf16
Contexto
205K
Salida máxima
131K
Entrada
$0.55
Salida
$2.2
Lectura de caché
$0.11
Escritura de caché
No indicado

Z.AI

fp4
Contexto
203K
Salida máxima
131K
Entrada
$0.6
Salida
$2.2
Lectura de caché
$0.11
Escritura de caché
No indicado
z-ai

4 modelos

Todos los modelos
z-ai logoz-ai

Z.ai: GLM 5.3 FlashX

GLM-5.3-FlashX is the high-speed variant of Z.ai's GLM-5.3-Flash, a native multimodal model delivering inference speeds of up to 200 tokens/s. Built on the same hybrid sparse and linear attention architecture...

Contexto
1.0M
Entrada
text · image · video
Salida
text
Entrada: $0.37Salida: $1.25por millón de tokens
Ver detalles del modelo
z-ai logoz-ai

Z.ai: GLM 5.3 Flash

GLM-5.3-Flash is a native multimodal model from Z.ai. It is suited for efficient coding and long-horizon agent tasks. Its hybrid sparse and linear attention architecture maintains accurate long-context behavior while...

Contexto
1.3M
Entrada
text · image · video
Salida
text
Entrada: $0.15Salida: $0.5por millón de tokens
Ver detalles del modelo
z-ai logoz-ai

Z.ai: GLM 5.3 Flash (batch)

GLM-5.3-Flash is a native multimodal model from Z.ai. It is suited for efficient coding and long-horizon agent tasks. Its hybrid sparse and linear attention architecture maintains accurate long-context behavior while...

Contexto
1.0M
Entrada
text · image · video
Salida
text
Entrada: $0.06Salida: $0.2por millón de tokens
Ver detalles del modelo
z-ai logoz-ai

Z.ai: GLM 5.3

GLM-5.3 is a large-scale reasoning model from Z.ai, built for complex software engineering and long-horizon agent tasks. It supports text input and output with a 1M-token context window, and improves...

Contexto
1.3M
Entrada
text
Salida
text
Entrada: $0.5614Salida: $1.7644por millón de tokens
Ver detalles del modelo