モデル仕様
- コンテキスト
- 262,144 tokens
- 最大出力
- 16,384 tokens
- アーキテクチャ
- text->text
- トークナイザー
- Other
- 知識カットオフ
- 情報なし
- モデレーション
- いいえ
料金の詳細
OpenRouterと同期した料金です。トークン料金は100万トークン単位です。
- 入力
- $0.5 /M tokens
- 出力
- $2.2 /M tokens
- キャッシュ読込
- $0.1 /M tokens
モデル設定
既定パラメータ
temperature- 1
top_p- 0.95
推論
- モデレーション
- いいえ
- 既定パラメータ
- high
- 機能とモダリティ
- high, medium
クイックスタート
OpenRouterのOpenAI互換APIでこのモデルIDを呼び出します。
curl https://openrouter.ai/api/v1/chat/completions \
-H "Authorization: Bearer $OPENROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"nvidia/nemotron-3-ultra-550b-a55b","messages":[{"role":"user","content":"Hello!"}]}'入力 → 出力
はい · high · medium
対応APIパラメータ
frequency_penaltyinclude_reasoninglogit_biasmax_tokensmin_ppresence_penaltyreasoningreasoning_effortrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_p3 プロバイダー
可用性、遅延、スループット、ルーティングは常時変化します。最新情報は出典ページで確認してください。
DeepInfra
fp4- コンテキスト
- 262K
- 最大出力
- 16K
- 入力
- $0.500
- 出力
- $2.20
- キャッシュ読込
- $0.100
- キャッシュ書込
- 情報なし
BaseTen
fp4- コンテキスト
- 203K
- 最大出力
- 183K
- 入力
- $0.600
- 出力
- $2.40
- キャッシュ読込
- $0.120
- キャッシュ書込
- 情報なし
Venice
fp8- コンテキスト
- 256K
- 最大出力
- 33K
- 入力
- $0.625
- 出力
- $3.13
- キャッシュ読込
- $0.188
- キャッシュ書込
- 情報なし