nvidia logo
nvidia

NVIDIA: Nemotron 3 Nano Omni (free)

NVIDIA Nemotron™ 3 Nano Omni is a 30B-A3B open multimodal model designed to function as a perception and context sub-agent in enterprise agent systems. This model is free to use. 256,000 token context window, maximum output of 65,536 tokens. Includes independent benchmarks from Artificial Analysis.

Visão geral

Especificações do modelo

Contexto
256.000 tokens
Saída máxima
65.536 tokens
Arquitetura
text+image+audio+video->text
Tokenizador
Other
Limite de conhecimento
Não informado
Moderado
Não
OPENROUTER

Preços completos

Tarifas sincronizadas do OpenRouter, por milhão de tokens.

Entrada
Grátis
/M tokens
Saída
Grátis
/M tokens
API

Configuração do modelo

Parâmetros padrão

temperature
0.6
top_p
0.95

Raciocínio

Moderado
Não
Parâmetros padrão
Sim
API

Início rápido

Use este modelo pela API compatível com OpenAI do OpenRouter.

curl https://openrouter.ai/api/v1/chat/completions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"nvidia/nemotron-3-nano-omni-30b-a3b-reasoning:free","messages":[{"role":"user","content":"Hello!"}]}'
Recursos e modalidades

EntradaSaída

Entrada
textaudioimagevideo
Saída
text
Raciocínio

Sim

API

Parâmetros de API compatíveis

include_reasoningmax_tokensreasoningseedtemperaturetool_choicetoolstop_p
Provedores disponíveis

0 provedores

Provedores ao vivo no OpenRouter

Disponibilidade, latência, throughput e roteamento mudam continuamente. Consulte a fonte para dados atuais.

OpenRouter

Nenhum detalhe de endpoint foi fornecido na última sincronização.

nvidia

modelos

Todos os modelos
nvidia logonvidia

NVIDIA: Nemotron 3.5 ASR Streaming Multilingual 0.6B

Nemotron 3.5 ASR Streaming Multilingual 0.6B is a speech recognition model from NVIDIA. Its prompt-conditioned, cache-aware FastConformer-RNNT design targets low-latency transcription across more than 40 languages for real-time captioning, voice...

Contexto
Não informado
Entrada
audio
Saída
transcription
Entrada: $3.33Saída: Grátispor milhão de tokens
Ver detalhes do modelo
nvidia logonvidia

NVIDIA: Nemotron 3.5 Lightning

NVIDIA Nemotron 3.5 Lightning is an open mixture-of-experts model from NVIDIA, with 3B active parameters out of 30B total. It is suited for high-throughput agentic workloads and specialized tasks that...

Contexto
262K
Entrada
text
Saída
text
Entrada: $0.080Saída: $0.200por milhão de tokens
Ver detalhes do modelo
nvidia logonvidia

NVIDIA: Nemotron 3.5 Lightning (free)

NVIDIA Nemotron 3.5 Lightning is an open mixture-of-experts model from NVIDIA, with 3B active parameters out of 30B total. It is suited for high-throughput agentic workloads and specialized tasks that...

Contexto
1M
Entrada
text
Saída
text
Entrada: GrátisSaída: Grátispor milhão de tokens
Ver detalhes do modelo
nvidia logonvidia

NVIDIA: Nemotron 3 Embed 1B (free)

NVIDIA Nemotron 3 Embed 1B is an open text embedding model from NVIDIA, optimized for high-throughput, low-latency retrieval. It is suited for enterprise search, RAG, code retrieval, and agentic retrieval...

Contexto
33K
Entrada
text
Saída
embeddings
Entrada: GrátisSaída: Grátispor milhão de tokens
Ver detalhes do modelo