z-ai logo
z-ai

Z.ai: GLM 4.6V

GLM-4.6V is a large multimodal model designed for high-fidelity visual understanding and long-context reasoning across images, documents, and mixed media. $0.30 per million input tokens, $0.90 per million output tokens. 131,072 token context window, maximum output of 32,768 tokens. Higher uptime with 2 providers. Includes independent benchmarks from Artificial Analysis.

Überblick

Modellspezifikationen

Kontext
131.072 tokens
Maximale Ausgabe
32.768 tokens
Architektur
text+image+video->text
Tokenizer
Other
Wissensstand
Nicht angegeben
Moderiert
Nein
OPENROUTER

Vollständige Preise

Mit OpenRouter synchronisierte Preise; Tokenpreise gelten pro eine Million Token.

Eingabe
$0.3
/M tokens
Ausgabe
$0.9
/M tokens
Cache-Lesen
$0.055
/M tokens
API

Modellkonfiguration

Standardparameter

temperature
0.8
top_p
0.6

Schlussfolgern

Moderiert
Nein
Standardparameter
Nein
API

Schnellstart

Dieses Modell über die OpenAI-kompatible API von OpenRouter aufrufen.

curl https://openrouter.ai/api/v1/chat/completions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"z-ai/glm-4.6v","messages":[{"role":"user","content":"Hello!"}]}'
Fähigkeiten und Modalitäten

EingabeAusgabe

Eingabe
imagetextvideo
Ausgabe
text
Schlussfolgern

Nein

API

Unterstützte API-Parameter

frequency_penaltyinclude_reasoningmax_tokenspresence_penaltyreasoningrepetition_penaltyresponse_formatseedstoptemperaturetool_choicetoolstop_ktop_p
Verfügbare Anbieter

2 Anbieter

Live-Anbieter bei OpenRouter

Verfügbarkeit, Latenz, Durchsatz und Routing ändern sich laufend. Aktuelle Betriebsdaten stehen auf der Quellseite.

OpenRouter

Novita

bf16
Kontext
131K
Maximale Ausgabe
33K
Eingabe
$0.300
Ausgabe
$0.900
Cache-Lesen
$0.055
Cache-Schreiben
Nicht angegeben

Z.AI

fp8
Kontext
131K
Maximale Ausgabe
33K
Eingabe
$0.300
Ausgabe
$0.900
Cache-Lesen
$0.050
Cache-Schreiben
Nicht angegeben
z-ai

Modelle

Alle Modelle