z-ai logo
z-ai

Z.ai: GLM 4.6

Opis źródłowy (angielski)

Compared with GLM-4.5, this generation brings several key improvements: Longer context window: The context window has been expanded from 128K to 200K tokens, enabling the model to handle more complex...

Przegląd

Specyfikacja modelu

Kontekst
204 800 tokens
Maksymalne wyjście
16 384 tokens
Architektura
text->text
Tokenizer
Other
Granica wiedzy
2025-03-31
Moderowany
Nie
OPENROUTER

Pełny cennik

Stawki zsynchronizowane z OpenRouter, za milion tokenów.

Wejście
$0.43
za milion tokenów
Wyjście
$1.75
za milion tokenów
Odczyt pamięci podręcznej
$0.08
za milion tokenów
API

Konfiguracja modelu

Parametry domyślne

temperature
0.6

Rozumowanie

Wymagane rozumowanie
Nie
Parametry domyślne
Nie
API

Szybki start

Ustaw lokalnie OPENROUTER_API_KEY. Python wymaga requests, a JavaScript działa w Node.js. Klucz przechowuj na serwerze.

Dokumentacja API

curl --fail-with-body https://openrouter.ai/api/v1/chat/completions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"z-ai/glm-4.6","messages":[{"role":"user","content":"Hello!"}]}'
Możliwości i modalności

WejścieWyjście

Wejście
text
Wyjście
text
Rozumowanie

Nie

API

Obsługiwane parametry API

frequency_penaltyinclude_reasoninglogit_biasmax_tokensmin_ppresence_penaltyreasoningrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_p
Dostępni dostawcy

4 dostawców

Sprawdzono: 20 września 2026

Dostawcy na żywo w OpenRouter

Dostępność, opóźnienie, przepustowość i routing stale się zmieniają. Aktualne dane są na stronie źródłowej.

OpenRouter

Venice

fp4
Kontekst
198K
Maksymalne wyjście
16K
Wejście
$0.43
Wyjście
$1.75
Odczyt pamięci podręcznej
$0.08
Zapis pamięci podręcznej
Brak danych

DeepInfra

fp4
Kontekst
203K
Maksymalne wyjście
131K
Wejście
$0.5
Wyjście
$2
Odczyt pamięci podręcznej
$0.1
Zapis pamięci podręcznej
Brak danych

Novita

bf16
Kontekst
205K
Maksymalne wyjście
131K
Wejście
$0.55
Wyjście
$2.2
Odczyt pamięci podręcznej
$0.11
Zapis pamięci podręcznej
Brak danych

Z.AI

fp4
Kontekst
203K
Maksymalne wyjście
131K
Wejście
$0.6
Wyjście
$2.2
Odczyt pamięci podręcznej
$0.11
Zapis pamięci podręcznej
Brak danych
z-ai

4 modele

Wszystkie modele
z-ai logoz-ai

Z.ai: GLM 5.3 FlashX

GLM-5.3-FlashX is the high-speed variant of Z.ai's GLM-5.3-Flash, a native multimodal model delivering inference speeds of up to 200 tokens/s. Built on the same hybrid sparse and linear attention architecture...

Kontekst
1.0M
Wejście
text · image · video
Wyjście
text
Wejście: $0.37Wyjście: $1.25za milion tokenów
Zobacz szczegóły modelu
z-ai logoz-ai

Z.ai: GLM 5.3 Flash

GLM-5.3-Flash is a native multimodal model from Z.ai. It is suited for efficient coding and long-horizon agent tasks. Its hybrid sparse and linear attention architecture maintains accurate long-context behavior while...

Kontekst
1.3M
Wejście
text · image · video
Wyjście
text
Wejście: $0.15Wyjście: $0.5za milion tokenów
Zobacz szczegóły modelu
z-ai logoz-ai

Z.ai: GLM 5.3 Flash (batch)

GLM-5.3-Flash is a native multimodal model from Z.ai. It is suited for efficient coding and long-horizon agent tasks. Its hybrid sparse and linear attention architecture maintains accurate long-context behavior while...

Kontekst
1.0M
Wejście
text · image · video
Wyjście
text
Wejście: $0.06Wyjście: $0.2za milion tokenów
Zobacz szczegóły modelu
z-ai logoz-ai

Z.ai: GLM 5.3

GLM-5.3 is a large-scale reasoning model from Z.ai, built for complex software engineering and long-horizon agent tasks. It supports text input and output with a 1M-token context window, and improves...

Kontekst
1.3M
Wejście
text
Wyjście
text
Wejście: $0.5614Wyjście: $1.7644za milion tokenów
Zobacz szczegóły modelu