inception logo
inception

Inception: Mercury 2.5 Preview

Descrição da fonte (inglês)

Mercury 2.5 is the fastest reasoning LLM, and the latest diffusion LLM (dLLM) from Inception. Instead of generating tokens sequentially, Mercury 2.5 produces and refines multiple tokens in parallel, achieving...

Visão geral

Especificações do modelo

Contexto
260.000 tokens
Saída máxima
65.536 tokens
Arquitetura
text->text
Tokenizador
Other
Limite de conhecimento
Não informado
Moderado
Não
OPENROUTER

Preços completos

Tarifas sincronizadas do OpenRouter, por milhão de tokens.

Entrada
$0.04
por milhão de tokens
Saída
$0.15
por milhão de tokens
Leitura de cache
$0.004
por milhão de tokens
API

Configuração do modelo

Raciocínio

Raciocínio obrigatório
Não
Parâmetros padrão
medium
Recursos e modalidades
high, medium, low, none
API

Início rápido

Defina OPENROUTER_API_KEY localmente. Python requer requests; JavaScript roda em Node.js. Mantenha a chave no servidor.

Documentação da API

curl --fail-with-body https://openrouter.ai/api/v1/chat/completions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"inception/mercury-2.5-preview","messages":[{"role":"user","content":"Hello!"}]}'
Recursos e modalidades

EntradaSaída

Entrada
text
Saída
text
Raciocínio

Sim · high · medium · low · none

API

Parâmetros de API compatíveis

include_reasoningmax_tokensreasoningreasoning_effortresponse_formatstopstructured_outputstemperaturetool_choicetools
Provedores disponíveis

1 Provedor

Verificado: 7 de setembro de 2026

Provedores ao vivo no OpenRouter

Disponibilidade, latência, throughput e roteamento mudam continuamente. Consulte a fonte para dados atuais.

OpenRouter

Inception

Não informado
Contexto
260K
Saída máxima
66K
Entrada
$0.04
Saída
$0.15
Leitura de cache
$0.004
Gravação de cache
Não informado
inception

1 modelos

Todos os modelos