nvidia logo
nvidia

NVIDIA: Nemotron 3 Nano 30B A3B

Descrizione della fonte (inglese)

NVIDIA Nemotron 3 Nano 30B A3B is a small language MoE model with highest compute efficiency and accuracy for developers to build specialized agentic AI systems. The model is fully...

Panoramica

Specifiche del modello

Contesto
262.144 tokens
Output massimo
235.929 tokens
Architettura
text->text
Tokenizer
Other
Limite di conoscenza
Non indicato
Moderato
No
OPENROUTER

Prezzi completi

Tariffe sincronizzate da OpenRouter, per milione di token.

Input
$0.05
per milione di token
Output
$0.2
per milione di token
Lettura cache
$0.03
per milione di token
API

Configurazione del modello

Ragionamento

Ragionamento obbligatorio
No
Parametri predefiniti
No
API

Avvio rapido

Imposta OPENROUTER_API_KEY localmente. Python richiede requests; JavaScript viene eseguito in Node.js. Conserva la chiave sul server.

Documentazione API

curl --fail-with-body https://openrouter.ai/api/v1/chat/completions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"nvidia/nemotron-3-nano-30b-a3b","messages":[{"role":"user","content":"Hello!"}]}'
Capacità e modalità

InputOutput

Input
text
Output
text
Ragionamento

No

API

Parametri API supportati

frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokensmin_ppresence_penaltyreasoningrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p
Provider disponibili

4 provider

Verificato: 22 settembre 2026

Provider live su OpenRouter

Disponibilità, latenza, throughput e routing cambiano continuamente. Consulta la fonte per i dati correnti.

OpenRouter

Crusoe

fp8
Contesto
262K
Output massimo
236K
Input
$0.05
Output
$0.2
Lettura cache
$0.03
Scrittura cache
Non indicato

Novita

fp4
Contesto
262K
Output massimo
33K
Input
$0.05
Output
$0.2
Lettura cache
Non indicato
Scrittura cache
Non indicato

DeepInfra

fp4
Contesto
262K
Output massimo
228K
Input
$0.05
Output
$0.2
Lettura cache
$0.025
Scrittura cache
Non indicato

Nebius

fp8
Contesto
262K
Output massimo
236K
Input
$0.06
Output
$0.24
Lettura cache
Non indicato
Scrittura cache
Non indicato
nvidia

4 modelli

Tutti i modelli
nvidia logonvidia

NVIDIA: Nemotron 3.5 ASR Streaming Multilingual 0.6B

Nemotron 3.5 ASR Streaming Multilingual 0.6B is a speech recognition model from NVIDIA. Its prompt-conditioned, cache-aware FastConformer-RNNT design targets low-latency transcription across more than 40 languages for real-time captioning, voice...

Contesto
Non indicato
Input
audio
Output
transcription
Durata audio: $0.000003 al secondo
Vedi i dettagli del modello
nvidia logonvidia

NVIDIA: Nemotron 3.5 Lightning

NVIDIA Nemotron 3.5 Lightning is an open mixture-of-experts model from NVIDIA, with 3B active parameters out of 30B total. It is suited for high-throughput agentic workloads and specialized tasks that...

Contesto
262K
Input
text
Output
text
Input: $0.08Output: $0.2per milione di token
Vedi i dettagli del modello
nvidia logonvidia

NVIDIA: Nemotron 3.5 Lightning (free)

NVIDIA Nemotron 3.5 Lightning is an open mixture-of-experts model from NVIDIA, with 3B active parameters out of 30B total. It is suited for high-throughput agentic workloads and specialized tasks that...

Contesto
1M
Input
text
Output
text
Input: GratuitoOutput: Gratuitoper milione di token
Vedi i dettagli del modello
nvidia logonvidia

NVIDIA: Nemotron 3 Embed 1B (free)

NVIDIA Nemotron 3 Embed 1B is an open text embedding model from NVIDIA, optimized for high-throughput, low-latency retrieval. It is suited for enterprise search, RAG, code retrieval, and agentic retrieval...

Contesto
33K
Input
text
Output
embeddings
Input: Gratuitoper milione di token
Vedi i dettagli del modello