z-ai logo
z-ai

Z.ai: GLM 5.3 Flash

출처 설명 (영어)

GLM-5.3-Flash is a native multimodal model from Z.ai. It is suited for efficient coding and long-horizon agent tasks. Its hybrid sparse and linear attention architecture maintains accurate long-context behavior while...

개요

모델 사양

컨텍스트
1,310,720 tokens
최대 출력
131,072 tokens
아키텍처
text+image+video->text
토크나이저
Other
지식 기준일
정보 없음
검토됨
아니요
OPENROUTER

전체 가격

OpenRouter에서 동기화한 요금이며 토큰 가격은 100만 토큰 기준입니다.

입력
$0.075
백만 토큰당
출력
$0.25
백만 토큰당
캐시 읽기
$0.015
백만 토큰당
API

모델 구성

기본 매개변수

temperature
1
top_p
0.95

추론

추론 필수 여부
기본 매개변수
max
기능 및 모달리티
max, high, low
API

빠른 시작

로컬에 OPENROUTER_API_KEY를 설정하세요. Python에는 requests가 필요하며 JavaScript는 Node.js에서 실행됩니다. 키는 서버에 보관하세요.

API 문서

curl --fail-with-body https://openrouter.ai/api/v1/chat/completions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"z-ai/glm-5.3-flash","messages":[{"role":"user","content":"Hello!"}]}'
기능 및 모달리티

입력출력

입력
textimagevideo
출력
text
추론

· max · high · low

API

지원 API 매개변수

frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokensmin_ppresence_penaltyreasoningreasoning_effortrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p
사용 가능한 제공업체

24 개 제공업체

확인일: 2026년 9월 7일

OpenRouter 실시간 제공업체

가용성, 지연 시간, 처리량과 라우팅은 계속 바뀝니다. 최신 운영 데이터는 출처 페이지에서 확인하세요.

OpenRouter

Relace

fp4
컨텍스트
1.0M
최대 출력
131K
입력
$0.0713
출력
$0.2375
캐시 읽기
$0.0143
캐시 쓰기
정보 없음

GMICloud

fp8
컨텍스트
1.0M
최대 출력
944K
입력
$0.075
출력
$0.25
캐시 읽기
$0.015
캐시 쓰기
정보 없음

Novita

fp8
컨텍스트
1.0M
최대 출력
131K
입력
$0.075
출력
$0.25
캐시 읽기
$0.015
캐시 쓰기
정보 없음

DeepInfra

fp4
컨텍스트
1.0M
최대 출력
131K
입력
$0.075
출력
$0.25
캐시 읽기
$0.015
캐시 쓰기
정보 없음

Z.AI

fp8
컨텍스트
1.0M
최대 출력
131K
입력
$0.075
출력
$0.25
캐시 읽기
$0.015
캐시 쓰기
정보 없음

Wafer

정보 없음
컨텍스트
1.0M
최대 출력
944K
입력
$0.1
출력
$0.35
캐시 읽기
$0.02
캐시 쓰기
정보 없음

StreamLake

fp8
컨텍스트
1.0M
최대 출력
128K
입력
$0.135
출력
$0.45
캐시 읽기
$0.027
캐시 쓰기
정보 없음

Makora

정보 없음
컨텍스트
1.0M
최대 출력
944K
입력
$0.14
출력
$0.47
캐시 읽기
$0.024
캐시 쓰기
정보 없음

Modal

fp8
컨텍스트
1.0M
최대 출력
944K
입력
$0.15
출력
$0.4999
캐시 읽기
$0.03
캐시 쓰기
정보 없음

CoreWeave

fp8
컨텍스트
1.0M
최대 출력
944K
입력
$0.15
출력
$0.5
캐시 읽기
$0.05
캐시 쓰기
정보 없음

Sail Research

fp8
컨텍스트
1.0M
최대 출력
131K
입력
$0.15
출력
$0.5
캐시 읽기
$0.03
캐시 쓰기
정보 없음

NextBit

fp8
컨텍스트
1.0M
최대 출력
128K
입력
$0.15
출력
$0.5
캐시 읽기
$0.03
캐시 쓰기
정보 없음

Fireworks

정보 없음
컨텍스트
1.0M
최대 출력
944K
입력
$0.15
출력
$0.5
캐시 읽기
$0.03
캐시 쓰기
정보 없음

Friendli

정보 없음
컨텍스트
1.0M
최대 출력
944K
입력
$0.15
출력
$0.5
캐시 읽기
$0.03
캐시 쓰기
정보 없음

SiliconFlow

fp8
컨텍스트
1.0M
최대 출력
262K
입력
$0.15
출력
$0.5
캐시 읽기
$0.03
캐시 쓰기
정보 없음

DigitalOcean

정보 없음
컨텍스트
1.0M
최대 출력
944K
입력
$0.15
출력
$0.5
캐시 읽기
$0.03
캐시 쓰기
정보 없음

Together

정보 없음
컨텍스트
1.0M
최대 출력
944K
입력
$0.15
출력
$0.5
캐시 읽기
$0.03
캐시 쓰기
정보 없음

Reka

fp8
컨텍스트
262K
최대 출력
236K
입력
$0.15
출력
$0.5
캐시 읽기
$0.03
캐시 쓰기
정보 없음

Parasail

fp8
컨텍스트
1.0M
최대 출력
944K
입력
$0.15
출력
$0.5
캐시 읽기
$0.03
캐시 쓰기
정보 없음

BaseTen

fp8
컨텍스트
1.0M
최대 출력
131K
입력
$0.15
출력
$0.5
캐시 읽기
$0.03
캐시 쓰기
정보 없음

Venice

정보 없음
컨텍스트
1.0M
최대 출력
131K
입력
$0.15
출력
$0.5
캐시 읽기
$0.03
캐시 쓰기
정보 없음

Io Net

fp8
컨텍스트
262K
최대 출력
131K
입력
$0.15
출력
$0.5
캐시 읽기
$0.03
캐시 쓰기
정보 없음

Cloudflare

정보 없음
컨텍스트
1.3M
최대 출력
1.2M
입력
$0.15
출력
$0.5
캐시 읽기
$0.03
캐시 쓰기
정보 없음

Morph

fp8
컨텍스트
1.0M
최대 출력
944K
입력
$0.388
출력
$1.358
캐시 읽기
$0.0776
캐시 쓰기
정보 없음
z-ai

4 개 모델

모든 모델