모델 사양
- 컨텍스트
- 512,288 tokens
- 최대 출력
- 461,059 tokens
- 아키텍처
- text->text
- 토크나이저
- Other
- 지식 기준일
- 정보 없음
- 검토됨
- 아니요
전체 가격
OpenRouter에서 동기화한 요금이며 토큰 가격은 100만 토큰 기준입니다.
- 입력
- $0.6 /M tokens
- 출력
- $3.6 /M tokens
- 캐시 읽기
- $0.2 /M tokens
모델 구성
기본 매개변수
temperature- 1
top_p- 0.95
추론
- 검토됨
- 아니요
- 기본 매개변수
- high
- 기능 및 모달리티
- high, medium
빠른 시작
OpenRouter의 OpenAI 호환 API로 이 모델 ID를 호출합니다.
curl https://openrouter.ai/api/v1/chat/completions \
-H "Authorization: Bearer $OPENROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"nvidia/nemotron-3-ultra-550b-a55b:batch","messages":[{"role":"user","content":"Hello!"}]}'입력 → 출력
예 · high · medium
지원 API 매개변수
frequency_penaltyinclude_reasoninglogit_biasmax_tokensmin_ppresence_penaltyreasoningreasoning_effortrepetition_penaltyresponse_formatstopstructured_outputstemperaturetool_choicetoolstop_ktop_p3 개 제공업체
가용성, 지연 시간, 처리량과 라우팅은 계속 바뀝니다. 최신 운영 데이터는 출처 페이지에서 확인하세요.
DeepInfra
fp4- 컨텍스트
- 262K
- 최대 출력
- 16K
- 입력
- $0.500
- 출력
- $2.20
- 캐시 읽기
- $0.100
- 캐시 쓰기
- 정보 없음
BaseTen
fp4- 컨텍스트
- 203K
- 최대 출력
- 183K
- 입력
- $0.600
- 출력
- $2.40
- 캐시 읽기
- $0.120
- 캐시 쓰기
- 정보 없음
Venice
fp8- 컨텍스트
- 256K
- 최대 출력
- 33K
- 입력
- $0.625
- 출력
- $3.13
- 캐시 읽기
- $0.188
- 캐시 쓰기
- 정보 없음