qwen logo
qwen

Qwen: Qwen3 Max

Qwen3-Max is an updated release built on the Qwen3 series, offering major improvements in reasoning, instruction following, multilingual support, and long-tail knowledge coverage compared to the January 2025 version. $0.78 per million input tokens, $3.90 per million output tokens. 262,144 token context window, maximum output of 65,536 tokens. Includes independent benchmarks from Artificial Analysis.

개요

모델 사양

컨텍스트
262,144 tokens
최대 출력
65,536 tokens
아키텍처
text->text
토크나이저
Qwen3
지식 기준일
2025-06-30
검토됨
아니요
OPENROUTER

전체 가격

OpenRouter에서 동기화한 요금이며 토큰 가격은 100만 토큰 기준입니다.

입력
$0.78
/M tokens
  • ≤32K$0.78
  • ≤128K$1.56
  • >128K$1.95
출력
$3.9
/M tokens
  • ≤32K$3.9
  • ≤128K$7.8
  • >128K$9.75
캐시 읽기
$0.156
/M tokens
  • ≤32K$0.156
  • ≤128K$0.312
  • >128K$0.39
Cache Creation (5min)
$0.975
/M tokens
  • ≤32K$0.975
  • ≤128K$1.95
  • >128K$2.4375
Cache Read (5min)
$0.078
/M tokens
  • ≤32K$0.078
  • ≤128K$0.156
  • >128K$0.195
API

모델 구성

기본 매개변수

temperature
1
top_p
1

추론

검토됨
아니요
기본 매개변수
아니요
API

빠른 시작

OpenRouter의 OpenAI 호환 API로 이 모델 ID를 호출합니다.

curl https://openrouter.ai/api/v1/chat/completions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"qwen/qwen3-max","messages":[{"role":"user","content":"Hello!"}]}'
기능 및 모달리티

입력출력

입력
text
출력
text
추론

아니요

API

지원 API 매개변수

frequency_penaltylogprobsmax_tokenspresence_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p
사용 가능한 제공업체

1 제공업체

OpenRouter 실시간 제공업체

가용성, 지연 시간, 처리량과 라우팅은 계속 바뀝니다. 최신 운영 데이터는 출처 페이지에서 확인하세요.

OpenRouter

Alibaba

unknown
컨텍스트
262K
최대 출력
66K
입력
$0.780
출력
$3.90
캐시 읽기
$0.156
캐시 쓰기
$0.975
qwen

개 모델

모든 모델