nvidia logo
nvidia

NVIDIA: Nemotron 3.5 Lightning

Opis źródłowy (angielski)

NVIDIA Nemotron 3.5 Lightning is an open mixture-of-experts model from NVIDIA, with 3B active parameters out of 30B total. It is suited for high-throughput agentic workloads and specialized tasks that...

Przegląd

Specyfikacja modelu

Kontekst
262 144 tokens
Maksymalne wyjście
131 072 tokens
Architektura
text->text
Tokenizer
Other
Granica wiedzy
Brak danych
Moderowany
Nie
OPENROUTER

Pełny cennik

Stawki zsynchronizowane z OpenRouter, za milion tokenów.

Wejście
$0.08
za milion tokenów
Wyjście
$0.2
za milion tokenów
Odczyt pamięci podręcznej
$0.04
za milion tokenów
API

Konfiguracja modelu

Rozumowanie

Wymagane rozumowanie
Nie
Parametry domyślne
Nie
API

Szybki start

Ustaw lokalnie OPENROUTER_API_KEY. Python wymaga requests, a JavaScript działa w Node.js. Klucz przechowuj na serwerze.

Dokumentacja API

curl --fail-with-body https://openrouter.ai/api/v1/chat/completions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"nvidia/nemotron-3.5-lightning","messages":[{"role":"user","content":"Hello!"}]}'
Możliwości i modalności

WejścieWyjście

Wejście
text
Wyjście
text
Rozumowanie

Nie

API

Obsługiwane parametry API

frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokensmin_ppresence_penaltyreasoningrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p
Dostępni dostawcy

4 dostawców

Sprawdzono: 23 września 2026

Dostawcy na żywo w OpenRouter

Dostępność, opóźnienie, przepustowość i routing stale się zmieniają. Aktualne dane są na stronie źródłowej.

OpenRouter

Darkbloom

int4
Kontekst
262K
Maksymalne wyjście
33K
Wejście
$0.065
Wyjście
$0.18
Odczyt pamięci podręcznej
Brak danych
Zapis pamięci podręcznej
Brak danych

Phala

Brak danych
Kontekst
262K
Maksymalne wyjście
236K
Wejście
$0.07
Wyjście
$0.2
Odczyt pamięci podręcznej
$0.04
Zapis pamięci podręcznej
Brak danych

CoreWeave

bf16
Kontekst
262K
Maksymalne wyjście
236K
Wejście
$0.07
Wyjście
$0.2
Odczyt pamięci podręcznej
$0.04
Zapis pamięci podręcznej
Brak danych

DeepInfra

bf16
Kontekst
262K
Maksymalne wyjście
131K
Wejście
$0.08
Wyjście
$0.2
Odczyt pamięci podręcznej
$0.04
Zapis pamięci podręcznej
Brak danych
nvidia

4 modele

Wszystkie modele
nvidia logonvidia

NVIDIA: Nemotron 3.5 ASR Streaming Multilingual 0.6B

Nemotron 3.5 ASR Streaming Multilingual 0.6B is a speech recognition model from NVIDIA. Its prompt-conditioned, cache-aware FastConformer-RNNT design targets low-latency transcription across more than 40 languages for real-time captioning, voice...

Kontekst
Brak danych
Wejście
audio
Wyjście
transcription
Czas audio: $0.000003 za sekundę
Zobacz szczegóły modelu
nvidia logonvidia

NVIDIA: Nemotron 3.5 Lightning (free)

NVIDIA Nemotron 3.5 Lightning is an open mixture-of-experts model from NVIDIA, with 3B active parameters out of 30B total. It is suited for high-throughput agentic workloads and specialized tasks that...

Kontekst
1M
Wejście
text
Wyjście
text
Wejście: BezpłatnieWyjście: Bezpłatnieza milion tokenów
Zobacz szczegóły modelu
nvidia logonvidia

NVIDIA: Nemotron 3 Embed 1B (free)

NVIDIA Nemotron 3 Embed 1B is an open text embedding model from NVIDIA, optimized for high-throughput, low-latency retrieval. It is suited for enterprise search, RAG, code retrieval, and agentic retrieval...

Kontekst
33K
Wejście
text
Wyjście
embeddings
Wejście: Bezpłatnieza milion tokenów
Zobacz szczegóły modelu
nvidia logonvidia

NVIDIA: Llama Nemotron Rerank VL 1B V2 (free)

Llama Nemotron Rerank VL 1B V2 is a 1.7B multimodal reranking model from NVIDIA. It evaluates the relevance of document images and text against user queries, designed for vision RAG...

Kontekst
10K
Wejście
text · image
Wyjście
rerank
Wejście: Bezpłatnie za milion tokenówWyjście: Bezpłatnie za milion tokenów
Zobacz szczegóły modelu