nvidia logo
nvidia

NVIDIA: Nemotron 3 Nano 30B A3B

NVIDIA Nemotron 3 Nano 30B A3B is a small language MoE model with highest compute efficiency and accuracy for developers to build specialized agentic AI systems. $0.05 per million input tokens, $0.20 per million output tokens. 262,144 token context window, maximum output of 228,000 tokens. Higher uptime with 4 providers. Includes independent benchmarks from Artificial Analysis.

Przegląd

Specyfikacja modelu

Kontekst
262 144 tokens
Maksymalne wyjście
228 000 tokens
Architektura
text->text
Tokenizer
Other
Granica wiedzy
Brak danych
Moderowany
Nie
OPENROUTER

Pełny cennik

Stawki zsynchronizowane z OpenRouter, za milion tokenów.

Wejście
$0.05
/M tokens
Wyjście
$0.2
/M tokens
Odczyt pamięci podręcznej
$0.025
/M tokens
API

Konfiguracja modelu

Rozumowanie

Moderowany
Nie
Parametry domyślne
Nie
API

Szybki start

Wywołaj ten model przez zgodne z OpenAI API OpenRouter.

curl https://openrouter.ai/api/v1/chat/completions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"nvidia/nemotron-3-nano-30b-a3b","messages":[{"role":"user","content":"Hello!"}]}'
Możliwości i modalności

WejścieWyjście

Wejście
text
Wyjście
text
Rozumowanie

Nie

API

Obsługiwane parametry API

frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokensmin_ppresence_penaltyreasoningrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p
Dostępni dostawcy

4 dostawców

Dostawcy na żywo w OpenRouter

Dostępność, opóźnienie, przepustowość i routing stale się zmieniają. Aktualne dane są na stronie źródłowej.

OpenRouter

DeepInfra

fp4
Kontekst
262K
Maksymalne wyjście
228K
Wejście
$0.050
Wyjście
$0.200
Odczyt pamięci podręcznej
$0.025
Zapis pamięci podręcznej
Brak danych

Novita

fp4
Kontekst
262K
Maksymalne wyjście
33K
Wejście
$0.050
Wyjście
$0.200
Odczyt pamięci podręcznej
Brak danych
Zapis pamięci podręcznej
Brak danych

Crusoe

fp8
Kontekst
262K
Maksymalne wyjście
236K
Wejście
$0.050
Wyjście
$0.200
Odczyt pamięci podręcznej
$0.030
Zapis pamięci podręcznej
Brak danych

Nebius

fp8
Kontekst
262K
Maksymalne wyjście
236K
Wejście
$0.060
Wyjście
$0.240
Odczyt pamięci podręcznej
Brak danych
Zapis pamięci podręcznej
Brak danych
nvidia

modele

Wszystkie modele
nvidia logonvidia

NVIDIA: Nemotron 3.5 ASR Streaming Multilingual 0.6B

Nemotron 3.5 ASR Streaming Multilingual 0.6B is a speech recognition model from NVIDIA. Its prompt-conditioned, cache-aware FastConformer-RNNT design targets low-latency transcription across more than 40 languages for real-time captioning, voice...

Kontekst
Brak danych
Wejście
audio
Wyjście
transcription
Wejście: $3.33Wyjście: Bezpłatnieza milion tokenów
Zobacz szczegóły modelu
nvidia logonvidia

NVIDIA: Nemotron 3.5 Lightning

NVIDIA Nemotron 3.5 Lightning is an open mixture-of-experts model from NVIDIA, with 3B active parameters out of 30B total. It is suited for high-throughput agentic workloads and specialized tasks that...

Kontekst
262K
Wejście
text
Wyjście
text
Wejście: $0.080Wyjście: $0.200za milion tokenów
Zobacz szczegóły modelu
nvidia logonvidia

NVIDIA: Nemotron 3.5 Lightning (free)

NVIDIA Nemotron 3.5 Lightning is an open mixture-of-experts model from NVIDIA, with 3B active parameters out of 30B total. It is suited for high-throughput agentic workloads and specialized tasks that...

Kontekst
1M
Wejście
text
Wyjście
text
Wejście: BezpłatnieWyjście: Bezpłatnieza milion tokenów
Zobacz szczegóły modelu
nvidia logonvidia

NVIDIA: Nemotron 3 Embed 1B (free)

NVIDIA Nemotron 3 Embed 1B is an open text embedding model from NVIDIA, optimized for high-throughput, low-latency retrieval. It is suited for enterprise search, RAG, code retrieval, and agentic retrieval...

Kontekst
33K
Wejście
text
Wyjście
embeddings
Wejście: BezpłatnieWyjście: Bezpłatnieza milion tokenów
Zobacz szczegóły modelu