Especificaciones del modelo
- Contexto
- 1.048.576 tokens
- Salida máxima
- 943.718 tokens
- Arquitectura
- text->text
- Tokenizador
- Other
- Corte de conocimiento
- No indicado
- Moderado
- No
Precios completos
Tarifas sincronizadas desde OpenRouter, por millón de tokens.
- Entrada
- $0.7 por millón de tokens
- Salida
- $2.2 por millón de tokens
- Lectura de caché
- $0.13 por millón de tokens
Configuración del modelo
Parámetros predeterminados
temperature- 1
top_p- 0.95
Razonamiento
- Razonamiento obligatorio
- Sí
- Parámetros predeterminados
- max
- Capacidades y modalidades
- max, high, low
Inicio rápido
Configura OPENROUTER_API_KEY localmente. Python requiere requests; JavaScript se ejecuta en Node.js. Mantén la clave en el servidor.
Esta solicitud envía un lote asíncrono con el ID del modelo base. El ID de la tarea confirma el envío, no la finalización.
curl --fail-with-body https://openrouter.ai/api/beta/batches \
-H "Authorization: Bearer $OPENROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{"endpoint":"/v1/chat/completions","model":"z-ai/glm-5.3","requests":[{"custom_id":"request-1","body":{"messages":[{"role":"user","content":"Hello!"}]}}]}'
# Replace JOB_ID with the returned id to check progress.
curl --fail-with-body "https://openrouter.ai/api/beta/batches/JOB_ID" \
-H "Authorization: Bearer $OPENROUTER_API_KEY"Entrada → Salida
Sí · max · high · low
Parámetros API compatibles
frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokenspresence_penaltyreasoningreasoning_effortrepetition_penaltyresponse_formatstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p1 Proveedor
Verificado: 9 de septiembre de 2026
Disponibilidad, latencia, rendimiento y enrutamiento cambian continuamente. Consulta la fuente para datos actuales.
Fireworks
No indicado- Contexto
- 1.0M
- Salida máxima
- 944K
- Entrada
- $0.7
- Salida
- $2.2
- Lectura de caché
- $0.13
- Escritura de caché
- No indicado