z-ai logo
z-ai

Z.ai: GLM 5.3

출처 설명 (영어)

GLM-5.3 is a large-scale reasoning model from Z.ai, built for complex software engineering and long-horizon agent tasks. It supports text input and output with a 1M-token context window, and improves...

개요

모델 사양

컨텍스트
1,310,720 tokens
최대 출력
943,717 tokens
아키텍처
text->text
토크나이저
Other
지식 기준일
정보 없음
검토됨
아니요
OPENROUTER

전체 가격

OpenRouter에서 동기화한 요금이며 토큰 가격은 100만 토큰 기준입니다.

입력
$1.4
백만 토큰당
출력
$4.4
백만 토큰당
캐시 읽기
$0.26
백만 토큰당
API

모델 구성

기본 매개변수

temperature
1
top_p
0.95

추론

추론 필수 여부
예
기본 매개변수
max
기능 및 모달리티
max, high, low
API

빠른 시작

로컬에 OPENROUTER_API_KEY를 설정하세요. Python에는 requests가 필요하며 JavaScript는 Node.js에서 실행됩니다. 키는 서버에 보관하세요.

API 문서

curl --fail-with-body https://openrouter.ai/api/v1/chat/completions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"z-ai/glm-5.3","messages":[{"role":"user","content":"Hello!"}]}'
기능 및 모달리티

입력 → 출력

입력
text
출력
text
추론

예 · max · high · low

API

지원 API 매개변수

frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokensmin_pparallel_tool_callspresence_penaltyreasoningreasoning_effortrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p
사용 가능한 제공업체

40 개 제공업체

확인일: 2026년 9월 28일

OpenRouter 실시간 제공업체

가용성, 지연 시간, 처리량과 라우팅은 계속 바뀝니다. 최신 운영 데이터는 출처 페이지에서 확인하세요.

OpenRouter

Reka

정보 없음
컨텍스트
262K
최대 출력
236K
입력
$0.3556
출력
$2.574
캐시 읽기
$0.066
캐시 쓰기
정보 없음

Inceptron

fp4
컨텍스트
1.0M
최대 출력
944K
입력
$0.4204
출력
$2.7392
캐시 읽기
$0.0967
캐시 쓰기
정보 없음

Morph

fp8
컨텍스트
1.0M
최대 출력
944K
입력
$0.4522
출력
$2.805
캐시 읽기
$0.1466
캐시 쓰기
정보 없음

Io Net

fp8
컨텍스트
262K
최대 출력
66K
입력
$0.5005
출력
$1.898
캐시 읽기
$0.091
캐시 쓰기
정보 없음

Relace

정보 없음
컨텍스트
1.0M
최대 출력
131K
입력
$0.55
출력
$1.7
캐시 읽기
$0.1
캐시 쓰기
정보 없음

DeepInfra

fp4
컨텍스트
1.0M
최대 출력
131K
입력
$0.5625
출력
$2.5
캐시 읽기
$0.125
캐시 쓰기
정보 없음

InferenceNet

정보 없음
컨텍스트
1.0M
최대 출력
131K
입력
$0.684
출력
$2.28
캐시 읽기
$0.114
캐시 쓰기
정보 없음

Sail Research

fp8
컨텍스트
1.0M
최대 출력
944K
입력
$0.77
출력
$4
캐시 읽기
$0.19
캐시 쓰기
정보 없음

Sail Research

fp8
컨텍스트
1.0M
최대 출력
944K
입력
$0.77
출력
$4
캐시 읽기
$0.19
캐시 쓰기
정보 없음

Novita

fp8
컨텍스트
1.0M
최대 출력
131K
입력
$0.7826
출력
$2.4596
캐시 읽기
$0.1453
캐시 쓰기
정보 없음

DigitalOcean

정보 없음
컨텍스트
1.0M
최대 출력
128K
입력
$0.91
출력
$2.86
캐시 읽기
$0.169
캐시 쓰기
정보 없음

Phala

정보 없음
컨텍스트
1.0M
최대 출력
131K
입력
$0.98
출력
$3.08
캐시 읽기
$0.182
캐시 쓰기
정보 없음

GMICloud

fp8
컨텍스트
1.0M
최대 출력
944K
입력
$0.98
출력
$3.08
캐시 읽기
$0.182
캐시 쓰기
정보 없음

Makora

fp4
컨텍스트
980K
최대 출력
128K
입력
$1.05
출력
$4.2
캐시 읽기
$0.19
캐시 쓰기
정보 없음

SiliconFlow

fp8
컨텍스트
1.0M
최대 출력
262K
입력
$1.12
출력
$3.52
캐시 읽기
$0.208
캐시 쓰기
정보 없음

Alibaba

정보 없음
컨텍스트
1M
최대 출력
131K
입력
$1.19
출력
$3.74
캐시 읽기
$0.238
캐시 쓰기
정보 없음

Decart

fp4
컨텍스트
1.0M
최대 출력
944K
입력
$1.19
출력
$3.74
캐시 읽기
$0.1955
캐시 쓰기
정보 없음

Friendli

정보 없음
컨텍스트
1.0M
최대 출력
944K
입력
$1.26
출력
$3.96
캐시 읽기
$0.234
캐시 쓰기
정보 없음

AkashML

fp8
컨텍스트
1.0M
최대 출력
131K
입력
$1.3
출력
$4.4
캐시 읽기
$0.26
캐시 쓰기
정보 없음

Mistral

nvfp4
컨텍스트
1.0M
최대 출력
131K
입력
$1.4
출력
$4.4
캐시 읽기
$0.14
캐시 쓰기
정보 없음

Wafer

정보 없음
컨텍스트
1.0M
최대 출력
944K
입력
$1.4
출력
$4.4
캐시 읽기
$0.26
캐시 쓰기
정보 없음

Baidu

fp8
컨텍스트
1.0M
최대 출력
131K
입력
$1.4
출력
$4.4
캐시 읽기
$0.26
캐시 쓰기
정보 없음

BaseTen

fp4
컨텍스트
1.0M
최대 출력
262K
입력
$1.4
출력
$4.4
캐시 읽기
$0.14
캐시 쓰기
정보 없음

Mistral

nvfp4
컨텍스트
1.0M
최대 출력
131K
입력
$1.4
출력
$4.4
캐시 읽기
$0.14
캐시 쓰기
정보 없음

Crusoe

fp4
컨텍스트
1.0M
최대 출력
944K
입력
$1.4
출력
$4.4
캐시 읽기
$0.26
캐시 쓰기
정보 없음

PrimeIntellect

정보 없음
컨텍스트
1.0M
최대 출력
131K
입력
$1.4
출력
$4.4
캐시 읽기
$0.26
캐시 쓰기
정보 없음

Venice

정보 없음
컨텍스트
1M
최대 출력
131K
입력
$1.4
출력
$4.4
캐시 읽기
$0.26
캐시 쓰기
정보 없음

Together

정보 없음
컨텍스트
1.0M
최대 출력
944K
입력
$1.4
출력
$4.4
캐시 읽기
$0.26
캐시 쓰기
정보 없음

Parasail

fp8
컨텍스트
1.0M
최대 출력
944K
입력
$1.4
출력
$4.4
캐시 읽기
$0.26
캐시 쓰기
정보 없음

Modal

정보 없음
컨텍스트
1.0M
최대 출력
944K
입력
$1.4
출력
$4.4
캐시 읽기
$0.26
캐시 쓰기
정보 없음

BaseTen

fp4
컨텍스트
1.0M
최대 출력
262K
입력
$1.4
출력
$4.4
캐시 읽기
$0.14
캐시 쓰기
정보 없음

Fireworks

정보 없음
컨텍스트
1.0M
최대 출력
944K
입력
$1.4
출력
$4.4
캐시 읽기
$0.26
캐시 쓰기
정보 없음

Cloudflare

정보 없음
컨텍스트
1.3M
최대 출력
1.2M
입력
$1.4
출력
$4.4
캐시 읽기
$0.26
캐시 쓰기
정보 없음

AtlasCloud

fp8
컨텍스트
1.0M
최대 출력
131K
입력
$1.4
출력
$4.4
캐시 읽기
$0.26
캐시 쓰기
정보 없음

Z.AI

fp8
컨텍스트
1.0M
최대 출력
131K
입력
$1.4
출력
$4.4
캐시 읽기
$0.26
캐시 쓰기
정보 없음

Mistral

nvfp4
컨텍스트
1.0M
최대 출력
131K
입력
$1.54
출력
$4.84
캐시 읽기
$0.154
캐시 쓰기
정보 없음

Wafer

정보 없음
컨텍스트
1.0M
최대 출력
944K
입력
$1.82
출력
$4.4
캐시 읽기
$0.26
캐시 쓰기
정보 없음

BaseTen

fp8
컨텍스트
1.0M
최대 출력
262K
입력
$2.1
출력
$6.6
캐시 읽기
$0.21
캐시 쓰기
정보 없음

BaseTen

fp8
컨텍스트
1.0M
최대 출력
262K
입력
$2.1
출력
$6.6
캐시 읽기
$0.21
캐시 쓰기
정보 없음

Alibaba

정보 없음
컨텍스트
1M
최대 출력
131K
입력
$2.8
출력
$8.8
캐시 읽기
$0.56
캐시 쓰기
정보 없음
z-ai

4 개 모델

모든 모델
z-ai logoz-ai

Z.ai: GLM 5.3 Prime

GLM-5.3-Prime is the high-speed variant of Z.ai's GLM-5.3, inheriting its full capabilities while delivering 1.5–2× the output throughput through inference acceleration. It supports text input and output with a 1M-token...

컨텍스트
1M
입력
text
출력
text
입력: $2.8출력: $8.8백만 토큰당
모델 상세 보기 →
z-ai logoz-ai

Z.ai: GLM 5.3 FlashX

GLM-5.3-FlashX is the high-speed variant of Z.ai's GLM-5.3-Flash, a native multimodal model delivering inference speeds of up to 200 tokens/s. Built on the same hybrid sparse and linear attention architecture...

컨텍스트
1.0M
입력
text · image · video
출력
text
입력: $0.37출력: $1.25백만 토큰당
모델 상세 보기 →
z-ai logoz-ai

Z.ai: GLM 5.3 Flash

GLM-5.3-Flash is a native multimodal model from Z.ai. It is suited for efficient coding and long-horizon agent tasks. Its hybrid sparse and linear attention architecture maintains accurate long-context behavior while...

컨텍스트
1.3M
입력
text · image · video
출력
text
입력: $0.15출력: $0.5백만 토큰당
모델 상세 보기 →
z-ai logoz-ai

Z.ai: GLM 5.3 Flash (batch)

GLM-5.3-Flash is a native multimodal model from Z.ai. It is suited for efficient coding and long-horizon agent tasks. Its hybrid sparse and linear attention architecture maintains accurate long-context behavior while...

컨텍스트
1.0M
입력
text · image · video
출력
text
입력: $0.06출력: $0.2백만 토큰당
모델 상세 보기 →