nvidia logo
nvidia

NVIDIA: Nemotron 3 Super

Opis źródłowy (angielski)

NVIDIA Nemotron 3 Super is a 120B-parameter open hybrid MoE model, activating just 12B parameters for maximum compute efficiency and accuracy in complex multi-agent applications. Built on a hybrid Mamba-Transformer...

Przegląd

Specyfikacja modelu

Kontekst
262 144 tokens
Maksymalne wyjście
235 929 tokens
Architektura
text->text
Tokenizer
Other
Granica wiedzy
Brak danych
Moderowany
Nie
OPENROUTER

Pełny cennik

Stawki zsynchronizowane z OpenRouter, za milion tokenów.

Wejście
$0.08
za milion tokenów
Wyjście
$0.45
za milion tokenów
API

Konfiguracja modelu

Parametry domyślne

temperature
1
top_p
0.95

Rozumowanie

Wymagane rozumowanie
Nie
Parametry domyślne
medium
Możliwości i modalności
medium, low
API

Szybki start

Ustaw lokalnie OPENROUTER_API_KEY. Python wymaga requests, a JavaScript działa w Node.js. Klucz przechowuj na serwerze.

Dokumentacja API

curl --fail-with-body https://openrouter.ai/api/v1/chat/completions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"nvidia/nemotron-3-super-120b-a12b","messages":[{"role":"user","content":"Hello!"}]}'
Możliwości i modalności

WejścieWyjście

Wejście
text
Wyjście
text
Rozumowanie

Tak · medium · low

API

Obsługiwane parametry API

frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokensmin_ppresence_penaltyreasoningreasoning_effortrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p
Dostępni dostawcy

2 dostawców

Sprawdzono: 15 września 2026

Dostawcy na żywo w OpenRouter

Dostępność, opóźnienie, przepustowość i routing stale się zmieniają. Aktualne dane są na stronie źródłowej.

OpenRouter

DekaLLM

fp8
Kontekst
262K
Maksymalne wyjście
236K
Wejście
$0.08
Wyjście
$0.45
Odczyt pamięci podręcznej
Brak danych
Zapis pamięci podręcznej
Brak danych

DeepInfra

bf16
Kontekst
262K
Maksymalne wyjście
16K
Wejście
$0.085
Wyjście
$0.4
Odczyt pamięci podręcznej
Brak danych
Zapis pamięci podręcznej
Brak danych
nvidia

4 modele

Wszystkie modele
nvidia logonvidia

NVIDIA: Nemotron 3.5 ASR Streaming Multilingual 0.6B

Nemotron 3.5 ASR Streaming Multilingual 0.6B is a speech recognition model from NVIDIA. Its prompt-conditioned, cache-aware FastConformer-RNNT design targets low-latency transcription across more than 40 languages for real-time captioning, voice...

Kontekst
Brak danych
Wejście
audio
Wyjście
transcription
Czas audio: $0.000003 za sekundę
Zobacz szczegóły modelu
nvidia logonvidia

NVIDIA: Nemotron 3.5 Lightning

NVIDIA Nemotron 3.5 Lightning is an open mixture-of-experts model from NVIDIA, with 3B active parameters out of 30B total. It is suited for high-throughput agentic workloads and specialized tasks that...

Kontekst
262K
Wejście
text
Wyjście
text
Wejście: $0.08Wyjście: $0.2za milion tokenów
Zobacz szczegóły modelu
nvidia logonvidia

NVIDIA: Nemotron 3.5 Lightning (free)

NVIDIA Nemotron 3.5 Lightning is an open mixture-of-experts model from NVIDIA, with 3B active parameters out of 30B total. It is suited for high-throughput agentic workloads and specialized tasks that...

Kontekst
1M
Wejście
text
Wyjście
text
Wejście: BezpłatnieWyjście: Bezpłatnieza milion tokenów
Zobacz szczegóły modelu
nvidia logonvidia

NVIDIA: Nemotron 3 Embed 1B (free)

NVIDIA Nemotron 3 Embed 1B is an open text embedding model from NVIDIA, optimized for high-throughput, low-latency retrieval. It is suited for enterprise search, RAG, code retrieval, and agentic retrieval...

Kontekst
33K
Wejście
text
Wyjście
embeddings
Wejście: Bezpłatnieza milion tokenów
Zobacz szczegóły modelu