inception logo
inception

Inception: Mercury 2.5 Preview

Description de la source (anglais)

Mercury 2.5 is the fastest reasoning LLM, and the latest diffusion LLM (dLLM) from Inception. Instead of generating tokens sequentially, Mercury 2.5 produces and refines multiple tokens in parallel, achieving...

Présentation

Caractéristiques du modèle

Contexte
260 000 tokens
Sortie maximale
65 536 tokens
Architecture
text->text
Tokenizer
Other
Limite des connaissances
Non indiqué
Modéré
Non
OPENROUTER

Tarification complète

Tarifs synchronisés depuis OpenRouter, par million de tokens.

Entrée
$0.04
par million de tokens
Sortie
$0.15
par million de tokens
Lecture du cache
$0.004
par million de tokens
API

Configuration du modèle

Raisonnement

Raisonnement obligatoire
Non
Paramètres par défaut
medium
Capacités et modalités
high, medium, low, none
API

Démarrage rapide

Définissez OPENROUTER_API_KEY localement. Python nécessite requests ; JavaScript s’exécute dans Node.js. Gardez la clé côté serveur.

Documentation de l’API

curl --fail-with-body https://openrouter.ai/api/v1/chat/completions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"inception/mercury-2.5-preview","messages":[{"role":"user","content":"Hello!"}]}'
Capacités et modalités

EntréeSortie

Entrée
text
Sortie
text
Raisonnement

Oui · high · medium · low · none

API

Paramètres API pris en charge

include_reasoningmax_tokensreasoningreasoning_effortresponse_formatstopstructured_outputstemperaturetool_choicetools
Fournisseurs disponibles

1 Fournisseur

Vérifié: 7 septembre 2026

Fournisseurs en direct sur OpenRouter

Disponibilité, latence, débit et routage évoluent en continu. Consultez la source pour les données en temps réel.

OpenRouter

Inception

Non indiqué
Contexte
260K
Sortie maximale
66K
Entrée
$0.04
Sortie
$0.15
Lecture du cache
$0.004
Écriture du cache
Non indiqué
inception

1 modèles

Tous les modèles