~z-ai logo
~z-ai

Z.ai: GLM Flash Latest

Descrizione della fonte (inglese)

This model always redirects to the latest model in the GLM Flash family.

Panoramica

Specifiche del modello

Contesto
1.310.720 tokens
Output massimo
131.072 tokens
Architettura
text+image+video->text
Tokenizer
Router
Limite di conoscenza
Non indicato
Moderato
No
OPENROUTER

Prezzi completi

Tariffe sincronizzate da OpenRouter, per milione di token.

Input
$0.0713
per milione di token
Output
$0.2375
per milione di token
Lettura cache
$0.0143
per milione di token
API

Configurazione del modello

Parametri predefiniti

temperature
1
top_p
0.95

Ragionamento

Ragionamento obbligatorio
Parametri predefiniti
max
Capacità e modalità
max, high, low
API

Avvio rapido

Imposta OPENROUTER_API_KEY localmente. Python richiede requests; JavaScript viene eseguito in Node.js. Conserva la chiave sul server.

Documentazione API

curl --fail-with-body https://openrouter.ai/api/v1/chat/completions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"~z-ai/glm-flash-latest","messages":[{"role":"user","content":"Hello!"}]}'
Capacità e modalità

InputOutput

Input
textimagevideo
Output
text
Ragionamento

· max · high · low

API

Parametri API supportati

frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokensmin_ppresence_penaltyreasoningreasoning_effortrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p
Provider disponibili

0 provider

Verificato: 7 settembre 2026

Provider live su OpenRouter

Disponibilità, latenza, throughput e routing cambiano continuamente. Consulta la fonte per i dati correnti.

OpenRouter

Nell’ultima sincronizzazione non erano disponibili dettagli sugli endpoint.

~z-ai

1 modelli

Tutti i modelli