z-ai logo
z-ai

Z.ai: GLM 5.3 Flash (batch)

Descripción de la fuente (inglés)

GLM-5.3-Flash is a native multimodal model from Z.ai. It is suited for efficient coding and long-horizon agent tasks. Its hybrid sparse and linear attention architecture maintains accurate long-context behavior while...

Resumen

Especificaciones del modelo

Contexto
1.048.576 tokens
Salida máxima
131.072 tokens
Arquitectura
text+image+video->text
Tokenizador
Other
Corte de conocimiento
No indicado
Moderado
No
OPENROUTER

Precios completos

Tarifas sincronizadas desde OpenRouter, por millón de tokens.

Entrada
$0.06
por millón de tokens
Salida
$0.2
por millón de tokens
Lectura de caché
$0.012
por millón de tokens
API

Configuración del modelo

Parámetros predeterminados

temperature
1
top_p
0.95

Razonamiento

Razonamiento obligatorio
Parámetros predeterminados
max
Capacidades y modalidades
max, high, low
API

Inicio rápido

Configura OPENROUTER_API_KEY localmente. Python requiere requests; JavaScript se ejecuta en Node.js. Mantén la clave en el servidor.

Esta solicitud envía un lote asíncrono con el ID del modelo base. El ID de la tarea confirma el envío, no la finalización.

Documentación de la API

curl --fail-with-body https://openrouter.ai/api/beta/batches \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"endpoint":"/v1/chat/completions","model":"z-ai/glm-5.3-flash","requests":[{"custom_id":"request-1","body":{"messages":[{"role":"user","content":"Hello!"}]}}]}'

# Replace JOB_ID with the returned id to check progress.
curl --fail-with-body "https://openrouter.ai/api/beta/batches/JOB_ID" \
  -H "Authorization: Bearer $OPENROUTER_API_KEY"
Capacidades y modalidades

EntradaSalida

Entrada
textimagevideo
Salida
text
Razonamiento

· max · high · low

API

Parámetros API compatibles

frequency_penaltyinclude_reasoninglogit_biasmax_tokensmin_ppresence_penaltyreasoningreasoning_effortrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_p
Proveedores disponibles

1 Proveedor

Verificado: 23 de septiembre de 2026

Proveedores en vivo en OpenRouter

Disponibilidad, latencia, rendimiento y enrutamiento cambian continuamente. Consulta la fuente para datos actuales.

OpenRouter

DeepInfra

fp4
Contexto
1.0M
Salida máxima
131K
Entrada
$0.06
Salida
$0.2
Lectura de caché
$0.012
Escritura de caché
No indicado
z-ai

4 modelos

Todos los modelos