Especificações do modelo
- Contexto
- 10.240 tokens
- Saída máxima
- 9.216 tokens
- Arquitetura
- text+image->rerank
- Tokenizador
- Other
- Limite de conhecimento
- Não informado
- Moderado
- Não
Preços completos
Tarifas sincronizadas do OpenRouter, por milhão de tokens.
- Entrada
- Grátis /M tokens
- Saída
- Grátis /M tokens
Início rápido
Use este modelo pela API compatível com OpenAI do OpenRouter.
curl https://openrouter.ai/api/v1/chat/completions \
-H "Authorization: Bearer $OPENROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"nvidia/llama-nemotron-rerank-vl-1b-v2:free","messages":[{"role":"user","content":"Hello!"}]}'Entrada → Saída
Parâmetros de API compatíveis
max_tokensseedtemperaturetop_p0 provedores
Disponibilidade, latência, throughput e roteamento mudam continuamente. Consulte a fonte para dados atuais.
Nenhum detalhe de endpoint foi fornecido na última sincronização.