z-ai logo
z-ai

Z.ai: GLM 4.6V

GLM-4.6V is a large multimodal model designed for high-fidelity visual understanding and long-context reasoning across images, documents, and mixed media. $0.30 per million input tokens, $0.90 per million output tokens. 131,072 token context window, maximum output of 32,768 tokens. Higher uptime with 2 providers. Includes independent benchmarks from Artificial Analysis.

Présentation

Caractéristiques du modèle

Contexte
131 072 tokens
Sortie maximale
32 768 tokens
Architecture
text+image+video->text
Tokenizer
Other
Limite des connaissances
Non indiqué
Modéré
Non
OPENROUTER

Tarification complète

Tarifs synchronisés depuis OpenRouter, par million de tokens.

Entrée
$0.3
/M tokens
Sortie
$0.9
/M tokens
Lecture du cache
$0.055
/M tokens
API

Configuration du modèle

Paramètres par défaut

temperature
0.8
top_p
0.6

Raisonnement

Modéré
Non
Paramètres par défaut
Non
API

Démarrage rapide

Appelez ce modèle via l’API compatible OpenAI d’OpenRouter.

curl https://openrouter.ai/api/v1/chat/completions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"z-ai/glm-4.6v","messages":[{"role":"user","content":"Hello!"}]}'
Capacités et modalités

EntréeSortie

Entrée
imagetextvideo
Sortie
text
Raisonnement

Non

API

Paramètres API pris en charge

frequency_penaltyinclude_reasoningmax_tokenspresence_penaltyreasoningrepetition_penaltyresponse_formatseedstoptemperaturetool_choicetoolstop_ktop_p
Fournisseurs disponibles

2 fournisseurs

Fournisseurs en direct sur OpenRouter

Disponibilité, latence, débit et routage évoluent en continu. Consultez la source pour les données en temps réel.

OpenRouter

Novita

bf16
Contexte
131K
Sortie maximale
33K
Entrée
$0.300
Sortie
$0.900
Lecture du cache
$0.055
Écriture du cache
Non indiqué

Z.AI

fp8
Contexte
131K
Sortie maximale
33K
Entrée
$0.300
Sortie
$0.900
Lecture du cache
$0.050
Écriture du cache
Non indiqué
z-ai

modèles

Tous les modèles