nvidia logo
nvidia

NVIDIA: Nemotron 3 Embed 1B (free)

Descrição da fonte (inglês)

NVIDIA Nemotron 3 Embed 1B is an open text embedding model from NVIDIA, optimized for high-throughput, low-latency retrieval. It is suited for enterprise search, RAG, code retrieval, and agentic retrieval...

Visão geral

Especificações do modelo

Contexto
32.768 tokens
Saída máxima
29.491 tokens
Arquitetura
text->embeddings
Tokenizador
Other
Limite de conhecimento
Não informado
Moderado
Não
OPENROUTER

Preços completos

Tarifas sincronizadas do OpenRouter, por milhão de tokens.

Entrada
Grátis
por milhão de tokens
API

Início rápido

Defina OPENROUTER_API_KEY localmente. Python requer requests; JavaScript roda em Node.js. Mantenha a chave no servidor.

Documentação da API

curl --fail-with-body https://openrouter.ai/api/v1/embeddings \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"nvidia/nemotron-3-embed-1b:free","input":"Your text here"}'
Recursos e modalidades

EntradaSaída

Entrada
text
Saída
embeddings
API

Parâmetros de API compatíveis

Provedores disponíveis

1 Provedor

Verificado: 16 de setembro de 2026

Provedores ao vivo no OpenRouter

Disponibilidade, latência, throughput e roteamento mudam continuamente. Consulte a fonte para dados atuais.

OpenRouter

Nvidia

Não informado
Contexto
33K
Saída máxima
29K
Entrada
Grátis
Saída
Grátis
Leitura de cache
Não informado
Gravação de cache
Não informado
nvidia

4 modelos

Todos os modelos
nvidia logonvidia

NVIDIA: Nemotron 3.5 ASR Streaming Multilingual 0.6B

Nemotron 3.5 ASR Streaming Multilingual 0.6B is a speech recognition model from NVIDIA. Its prompt-conditioned, cache-aware FastConformer-RNNT design targets low-latency transcription across more than 40 languages for real-time captioning, voice...

Contexto
Não informado
Entrada
audio
Saída
transcription
Duração do áudio: $0.000003 por segundo
Ver detalhes do modelo
nvidia logonvidia

NVIDIA: Nemotron 3.5 Lightning

NVIDIA Nemotron 3.5 Lightning is an open mixture-of-experts model from NVIDIA, with 3B active parameters out of 30B total. It is suited for high-throughput agentic workloads and specialized tasks that...

Contexto
262K
Entrada
text
Saída
text
Entrada: $0.08Saída: $0.2por milhão de tokens
Ver detalhes do modelo
nvidia logonvidia

NVIDIA: Nemotron 3.5 Lightning (free)

NVIDIA Nemotron 3.5 Lightning is an open mixture-of-experts model from NVIDIA, with 3B active parameters out of 30B total. It is suited for high-throughput agentic workloads and specialized tasks that...

Contexto
1M
Entrada
text
Saída
text
Entrada: GrátisSaída: Grátispor milhão de tokens
Ver detalhes do modelo
nvidia logonvidia

NVIDIA: Llama Nemotron Rerank VL 1B V2 (free)

Llama Nemotron Rerank VL 1B V2 is a 1.7B multimodal reranking model from NVIDIA. It evaluates the relevance of document images and text against user queries, designed for vision RAG...

Contexto
10K
Entrada
text · image
Saída
rerank
Entrada: Grátis por milhão de tokensSaída: Grátis por milhão de tokens
Ver detalhes do modelo