z-ai logo
z-ai

Z.ai: GLM 4.6V

Opis źródłowy (angielski)

GLM-4.6V is a large multimodal model designed for high-fidelity visual understanding and long-context reasoning across images, documents, and mixed media. It supports up to 128K tokens, processes complex page layouts...

Przegląd

Specyfikacja modelu

Kontekst
131 072 tokens
Maksymalne wyjście
32 768 tokens
Architektura
text+image+video->text
Tokenizer
Other
Granica wiedzy
Brak danych
Moderowany
Nie
OPENROUTER

Pełny cennik

Stawki zsynchronizowane z OpenRouter, za milion tokenów.

Wejście
$0.3
za milion tokenów
Wyjście
$0.9
za milion tokenów
Odczyt pamięci podręcznej
$0.055
za milion tokenów
API

Konfiguracja modelu

Parametry domyślne

temperature
0.8
top_p
0.6

Rozumowanie

Wymagane rozumowanie
Nie
Parametry domyślne
Nie
API

Szybki start

Ustaw lokalnie OPENROUTER_API_KEY. Python wymaga requests, a JavaScript działa w Node.js. Klucz przechowuj na serwerze.

Dokumentacja API

curl --fail-with-body https://openrouter.ai/api/v1/chat/completions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"z-ai/glm-4.6v","messages":[{"role":"user","content":"Hello!"}]}'
Możliwości i modalności

WejścieWyjście

Wejście
imagetextvideo
Wyjście
text
Rozumowanie

Nie

API

Obsługiwane parametry API

frequency_penaltyinclude_reasoningmax_tokenspresence_penaltyreasoningrepetition_penaltyresponse_formatseedstoptemperaturetool_choicetoolstop_ktop_p
Dostępni dostawcy

2 dostawców

Sprawdzono: 7 września 2026

Dostawcy na żywo w OpenRouter

Dostępność, opóźnienie, przepustowość i routing stale się zmieniają. Aktualne dane są na stronie źródłowej.

OpenRouter

Novita

bf16
Kontekst
131K
Maksymalne wyjście
33K
Wejście
$0.3
Wyjście
$0.9
Odczyt pamięci podręcznej
$0.055
Zapis pamięci podręcznej
Brak danych

Z.AI

fp8
Kontekst
131K
Maksymalne wyjście
33K
Wejście
$0.3
Wyjście
$0.9
Odczyt pamięci podręcznej
$0.05
Zapis pamięci podręcznej
Brak danych
z-ai

4 modele

Wszystkie modele
z-ai logoz-ai

Z.ai: GLM 5.3 FlashX

GLM-5.3-FlashX is the high-speed variant of Z.ai's GLM-5.3-Flash, a native multimodal model delivering inference speeds of up to 200 tokens/s. Built on the same hybrid sparse and linear attention architecture...

Kontekst
1.0M
Wejście
text · image · video
Wyjście
text
Wejście: $0.37Wyjście: $1.25za milion tokenów
Zobacz szczegóły modelu
z-ai logoz-ai

Z.ai: GLM 5.3 Flash

GLM-5.3-Flash is a native multimodal model from Z.ai. It is suited for efficient coding and long-horizon agent tasks. Its hybrid sparse and linear attention architecture maintains accurate long-context behavior while...

Kontekst
1.3M
Wejście
text · image · video
Wyjście
text
Wejście: $0.15Wyjście: $0.5za milion tokenów
Zobacz szczegóły modelu
z-ai logoz-ai

Z.ai: GLM 5.3 Flash (batch)

GLM-5.3-Flash is a native multimodal model from Z.ai. It is suited for efficient coding and long-horizon agent tasks. Its hybrid sparse and linear attention architecture maintains accurate long-context behavior while...

Kontekst
1.0M
Wejście
text · image · video
Wyjście
text
Wejście: $0.06Wyjście: $0.2za milion tokenów
Zobacz szczegóły modelu
z-ai logoz-ai

Z.ai: GLM 5.3

GLM-5.3 is a large-scale reasoning model from Z.ai, built for complex software engineering and long-horizon agent tasks. It supports text input and output with a 1M-token context window, and improves...

Kontekst
1.3M
Wejście
text
Wyjście
text
Wejście: $0.5614Wyjście: $1.7644za milion tokenów
Zobacz szczegóły modelu