nvidia logo
nvidia

NVIDIA: Nemotron 3 Nano 30B A3B

出典の説明(英語)

NVIDIA Nemotron 3 Nano 30B A3B is a small language MoE model with highest compute efficiency and accuracy for developers to build specialized agentic AI systems. The model is fully...

概要

モデル仕様

コンテキスト
262,144 tokens
最大出力
235,929 tokens
アーキテクチャ
text->text
トークナイザー
Other
知識カットオフ
情報なし
モデレーション
いいえ
OPENROUTER

料金の詳細

OpenRouterと同期した料金です。トークン料金は100万トークン単位です。

入力
$0.05
100万トークンあたり
出力
$0.2
100万トークンあたり
キャッシュ読込
$0.03
100万トークンあたり
API

モデル設定

推論

推論の必須設定
いいえ
既定パラメータ
いいえ
API

クイックスタート

ローカルにOPENROUTER_API_KEYを設定してください。Pythonにはrequestsが必要です。JavaScriptはNode.jsで実行し、キーはサーバー側で管理してください。

APIドキュメント

curl --fail-with-body https://openrouter.ai/api/v1/chat/completions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"nvidia/nemotron-3-nano-30b-a3b","messages":[{"role":"user","content":"Hello!"}]}'
機能とモダリティ

入力出力

入力
text
出力
text
推論

いいえ

API

対応APIパラメータ

frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokensmin_ppresence_penaltyreasoningrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p
利用可能なプロバイダー

4 プロバイダー

確認日: 2026年9月22日

OpenRouterでプロバイダーを見る

可用性、遅延、スループット、ルーティングは常時変化します。最新情報は出典ページで確認してください。

OpenRouter

Crusoe

fp8
コンテキスト
262K
最大出力
236K
入力
$0.05
出力
$0.2
キャッシュ読込
$0.03
キャッシュ書込
情報なし

Novita

fp4
コンテキスト
262K
最大出力
33K
入力
$0.05
出力
$0.2
キャッシュ読込
情報なし
キャッシュ書込
情報なし

DeepInfra

fp4
コンテキスト
262K
最大出力
228K
入力
$0.05
出力
$0.2
キャッシュ読込
$0.025
キャッシュ書込
情報なし

Nebius

fp8
コンテキスト
262K
最大出力
236K
入力
$0.06
出力
$0.24
キャッシュ読込
情報なし
キャッシュ書込
情報なし
nvidia

4 モデル

すべてのモデル
nvidia logonvidia

NVIDIA: Nemotron 3.5 ASR Streaming Multilingual 0.6B

Nemotron 3.5 ASR Streaming Multilingual 0.6B is a speech recognition model from NVIDIA. Its prompt-conditioned, cache-aware FastConformer-RNNT design targets low-latency transcription across more than 40 languages for real-time captioning, voice...

コンテキスト
情報なし
入力
audio
出力
transcription
音声の長さ: $0.000003 1秒あたり
モデル詳細を見る
nvidia logonvidia

NVIDIA: Nemotron 3.5 Lightning

NVIDIA Nemotron 3.5 Lightning is an open mixture-of-experts model from NVIDIA, with 3B active parameters out of 30B total. It is suited for high-throughput agentic workloads and specialized tasks that...

コンテキスト
262K
入力
text
出力
text
入力: $0.08出力: $0.2100万トークンあたり
モデル詳細を見る
nvidia logonvidia

NVIDIA: Nemotron 3.5 Lightning (free)

NVIDIA Nemotron 3.5 Lightning is an open mixture-of-experts model from NVIDIA, with 3B active parameters out of 30B total. It is suited for high-throughput agentic workloads and specialized tasks that...

コンテキスト
1M
入力
text
出力
text
入力: 無料出力: 無料100万トークンあたり
モデル詳細を見る
nvidia logonvidia

NVIDIA: Nemotron 3 Embed 1B (free)

NVIDIA Nemotron 3 Embed 1B is an open text embedding model from NVIDIA, optimized for high-throughput, low-latency retrieval. It is suited for enterprise search, RAG, code retrieval, and agentic retrieval...

コンテキスト
33K
入力
text
出力
embeddings
入力: 無料100万トークンあたり
モデル詳細を見る