nvidia logo
nvidia

NVIDIA: Nemotron 3 Super (free)

Descrizione della fonte (inglese)

NVIDIA Nemotron 3 Super is a 120B-parameter open hybrid MoE model, activating just 12B parameters for maximum compute efficiency and accuracy in complex multi-agent applications. Built on a hybrid Mamba-Transformer...

Panoramica

Specifiche del modello

Contesto
262.144 tokens
Output massimo
235.929 tokens
Architettura
text->text
Tokenizer
Other
Limite di conoscenza
Non indicato
Moderato
No
OPENROUTER

Prezzi completi

Tariffe sincronizzate da OpenRouter, per milione di token.

Input
Gratuito
per milione di token
Output
Gratuito
per milione di token
API

Configurazione del modello

Parametri predefiniti

temperature
1
top_p
0.95

Ragionamento

Ragionamento obbligatorio
No
Parametri predefiniti
medium
Capacità e modalità
medium, low
API

Avvio rapido

Imposta OPENROUTER_API_KEY localmente. Python richiede requests; JavaScript viene eseguito in Node.js. Conserva la chiave sul server.

Documentazione API

curl --fail-with-body https://openrouter.ai/api/v1/chat/completions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"nvidia/nemotron-3-super-120b-a12b:free","messages":[{"role":"user","content":"Hello!"}]}'
Capacità e modalità

InputOutput

Input
text
Output
text
Ragionamento

· medium · low

API

Parametri API supportati

include_reasoningmax_tokensreasoningreasoning_effortresponse_formatseedstructured_outputstemperaturetool_choicetoolstop_p
Provider disponibili

1 Provider

Verificato: 7 settembre 2026

Provider live su OpenRouter

Disponibilità, latenza, throughput e routing cambiano continuamente. Consulta la fonte per i dati correnti.

OpenRouter

Nvidia

Non indicato
Contesto
262K
Output massimo
236K
Input
Gratuito
Output
Gratuito
Lettura cache
Non indicato
Scrittura cache
Non indicato
nvidia

4 modelli

Tutti i modelli
nvidia logonvidia

NVIDIA: Nemotron 3.5 ASR Streaming Multilingual 0.6B

Nemotron 3.5 ASR Streaming Multilingual 0.6B is a speech recognition model from NVIDIA. Its prompt-conditioned, cache-aware FastConformer-RNNT design targets low-latency transcription across more than 40 languages for real-time captioning, voice...

Contesto
Non indicato
Input
audio
Output
transcription
Durata audio: $0.000003 al secondo
Vedi i dettagli del modello
nvidia logonvidia

NVIDIA: Nemotron 3.5 Lightning

NVIDIA Nemotron 3.5 Lightning is an open mixture-of-experts model from NVIDIA, with 3B active parameters out of 30B total. It is suited for high-throughput agentic workloads and specialized tasks that...

Contesto
262K
Input
text
Output
text
Input: $0.08Output: $0.2per milione di token
Vedi i dettagli del modello
nvidia logonvidia

NVIDIA: Nemotron 3.5 Lightning (free)

NVIDIA Nemotron 3.5 Lightning is an open mixture-of-experts model from NVIDIA, with 3B active parameters out of 30B total. It is suited for high-throughput agentic workloads and specialized tasks that...

Contesto
1M
Input
text
Output
text
Input: GratuitoOutput: Gratuitoper milione di token
Vedi i dettagli del modello
nvidia logonvidia

NVIDIA: Nemotron 3 Embed 1B (free)

NVIDIA Nemotron 3 Embed 1B is an open text embedding model from NVIDIA, optimized for high-throughput, low-latency retrieval. It is suited for enterprise search, RAG, code retrieval, and agentic retrieval...

Contesto
33K
Input
text
Output
embeddings
Input: Gratuitoper milione di token
Vedi i dettagli del modello