nvidia logo
nvidia

NVIDIA: Nemotron 3 Nano 30B A3B

Opis źródłowy (angielski)

NVIDIA Nemotron 3 Nano 30B A3B is a small language MoE model with highest compute efficiency and accuracy for developers to build specialized agentic AI systems. The model is fully...

Przegląd

Specyfikacja modelu

Kontekst
262 144 tokens
Maksymalne wyjście
235 929 tokens
Architektura
text->text
Tokenizer
Other
Granica wiedzy
Brak danych
Moderowany
Nie
OPENROUTER

Pełny cennik

Stawki zsynchronizowane z OpenRouter, za milion tokenów.

Wejście
$0.05
za milion tokenów
Wyjście
$0.2
za milion tokenów
Odczyt pamięci podręcznej
$0.03
za milion tokenów
API

Konfiguracja modelu

Rozumowanie

Wymagane rozumowanie
Nie
Parametry domyślne
Nie
API

Szybki start

Ustaw lokalnie OPENROUTER_API_KEY. Python wymaga requests, a JavaScript działa w Node.js. Klucz przechowuj na serwerze.

Dokumentacja API

curl --fail-with-body https://openrouter.ai/api/v1/chat/completions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"nvidia/nemotron-3-nano-30b-a3b","messages":[{"role":"user","content":"Hello!"}]}'
Możliwości i modalności

WejścieWyjście

Wejście
text
Wyjście
text
Rozumowanie

Nie

API

Obsługiwane parametry API

frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokensmin_ppresence_penaltyreasoningrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p
Dostępni dostawcy

4 dostawców

Sprawdzono: 22 września 2026

Dostawcy na żywo w OpenRouter

Dostępność, opóźnienie, przepustowość i routing stale się zmieniają. Aktualne dane są na stronie źródłowej.

OpenRouter

Crusoe

fp8
Kontekst
262K
Maksymalne wyjście
236K
Wejście
$0.05
Wyjście
$0.2
Odczyt pamięci podręcznej
$0.03
Zapis pamięci podręcznej
Brak danych

Novita

fp4
Kontekst
262K
Maksymalne wyjście
33K
Wejście
$0.05
Wyjście
$0.2
Odczyt pamięci podręcznej
Brak danych
Zapis pamięci podręcznej
Brak danych

DeepInfra

fp4
Kontekst
262K
Maksymalne wyjście
228K
Wejście
$0.05
Wyjście
$0.2
Odczyt pamięci podręcznej
$0.025
Zapis pamięci podręcznej
Brak danych

Nebius

fp8
Kontekst
262K
Maksymalne wyjście
236K
Wejście
$0.06
Wyjście
$0.24
Odczyt pamięci podręcznej
Brak danych
Zapis pamięci podręcznej
Brak danych
nvidia

4 modele

Wszystkie modele
nvidia logonvidia

NVIDIA: Nemotron 3.5 ASR Streaming Multilingual 0.6B

Nemotron 3.5 ASR Streaming Multilingual 0.6B is a speech recognition model from NVIDIA. Its prompt-conditioned, cache-aware FastConformer-RNNT design targets low-latency transcription across more than 40 languages for real-time captioning, voice...

Kontekst
Brak danych
Wejście
audio
Wyjście
transcription
Czas audio: $0.000003 za sekundę
Zobacz szczegóły modelu
nvidia logonvidia

NVIDIA: Nemotron 3.5 Lightning

NVIDIA Nemotron 3.5 Lightning is an open mixture-of-experts model from NVIDIA, with 3B active parameters out of 30B total. It is suited for high-throughput agentic workloads and specialized tasks that...

Kontekst
262K
Wejście
text
Wyjście
text
Wejście: $0.08Wyjście: $0.2za milion tokenów
Zobacz szczegóły modelu
nvidia logonvidia

NVIDIA: Nemotron 3.5 Lightning (free)

NVIDIA Nemotron 3.5 Lightning is an open mixture-of-experts model from NVIDIA, with 3B active parameters out of 30B total. It is suited for high-throughput agentic workloads and specialized tasks that...

Kontekst
1M
Wejście
text
Wyjście
text
Wejście: BezpłatnieWyjście: Bezpłatnieza milion tokenów
Zobacz szczegóły modelu
nvidia logonvidia

NVIDIA: Nemotron 3 Embed 1B (free)

NVIDIA Nemotron 3 Embed 1B is an open text embedding model from NVIDIA, optimized for high-throughput, low-latency retrieval. It is suited for enterprise search, RAG, code retrieval, and agentic retrieval...

Kontekst
33K
Wejście
text
Wyjście
embeddings
Wejście: Bezpłatnieza milion tokenów
Zobacz szczegóły modelu