z-ai logo
z-ai

Z.ai: GLM 5.3 Flash (batch)

출처 설명 (영어)

GLM-5.3-Flash is a native multimodal model from Z.ai. It is suited for efficient coding and long-horizon agent tasks. Its hybrid sparse and linear attention architecture maintains accurate long-context behavior while...

개요

모델 사양

컨텍스트
1,048,576 tokens
최대 출력
131,072 tokens
아키텍처
text+image+video->text
토크나이저
Other
지식 기준일
정보 없음
검토됨
아니요
OPENROUTER

전체 가격

OpenRouter에서 동기화한 요금이며 토큰 가격은 100만 토큰 기준입니다.

입력
$0.06
백만 토큰당
출력
$0.2
백만 토큰당
캐시 읽기
$0.012
백만 토큰당
API

모델 구성

기본 매개변수

temperature
1
top_p
0.95

추론

추론 필수 여부
기본 매개변수
max
기능 및 모달리티
max, high, low
API

빠른 시작

로컬에 OPENROUTER_API_KEY를 설정하세요. Python에는 requests가 필요하며 JavaScript는 Node.js에서 실행됩니다. 키는 서버에 보관하세요.

기본 모델 ID로 비동기 배치를 제출합니다. 작업 ID는 제출 확인이며 완료를 뜻하지 않습니다.

API 문서

curl --fail-with-body https://openrouter.ai/api/beta/batches \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"endpoint":"/v1/chat/completions","model":"z-ai/glm-5.3-flash","requests":[{"custom_id":"request-1","body":{"messages":[{"role":"user","content":"Hello!"}]}}]}'

# Replace JOB_ID with the returned id to check progress.
curl --fail-with-body "https://openrouter.ai/api/beta/batches/JOB_ID" \
  -H "Authorization: Bearer $OPENROUTER_API_KEY"
기능 및 모달리티

입력출력

입력
textimagevideo
출력
text
추론

· max · high · low

API

지원 API 매개변수

frequency_penaltyinclude_reasoninglogit_biasmax_tokensmin_ppresence_penaltyreasoningreasoning_effortrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_p
사용 가능한 제공업체

1 제공업체

확인일: 2026년 9월 23일

OpenRouter 실시간 제공업체

가용성, 지연 시간, 처리량과 라우팅은 계속 바뀝니다. 최신 운영 데이터는 출처 페이지에서 확인하세요.

OpenRouter

DeepInfra

fp4
컨텍스트
1.0M
최대 출력
131K
입력
$0.06
출력
$0.2
캐시 읽기
$0.012
캐시 쓰기
정보 없음
z-ai

4 개 모델

모든 모델