thinkingmachines logo
thinkingmachines

Thinking Machines: Inkling Small

Description de la source (anglais)

Inkling Small is an open-weight multimodal mixture-of-experts model from Thinking Machines Lab, with 12B active parameters out of 276B total. It is positioned as the smaller, more efficient member of...

Présentation

Caractéristiques du modèle

Contexte
1 048 576 tokens
Sortie maximale
262 144 tokens
Architecture
text+image+audio->text
Tokenizer
Other
Limite des connaissances
Non indiqué
Modéré
Non
OPENROUTER

Tarification complète

Tarifs synchronisés depuis OpenRouter, par million de tokens.

Entrée
$0.45
par million de tokens
Sortie
$1.2
par million de tokens
Lecture du cache
$0.1
par million de tokens
API

Configuration du modèle

Raisonnement

Raisonnement obligatoire
Non
Paramètres par défaut
high
Capacités et modalités
max, high, medium, low, minimal, none
API

Démarrage rapide

Définissez OPENROUTER_API_KEY localement. Python nécessite requests ; JavaScript s’exécute dans Node.js. Gardez la clé côté serveur.

Documentation de l’API

curl --fail-with-body https://openrouter.ai/api/v1/chat/completions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"thinkingmachines/inkling-small","messages":[{"role":"user","content":"Hello!"}]}'
Capacités et modalités

EntréeSortie

Entrée
textimageaudio
Sortie
text
Raisonnement

Oui · max · high · medium · low · minimal · none

API

Paramètres API pris en charge

frequency_penaltyinclude_reasoninglogit_biasmax_tokensmin_ppresence_penaltyreasoningreasoning_effortrepetition_penaltyseedstoptemperaturetool_choicetoolstop_ktop_p
Fournisseurs disponibles

2 fournisseurs

Vérifié: 23 septembre 2026

Fournisseurs en direct sur OpenRouter

Disponibilité, latence, débit et routage évoluent en continu. Consultez la source pour les données en temps réel.

OpenRouter

DeepInfra

fp8
Contexte
524K
Sortie maximale
262K
Entrée
$0.45
Sortie
$1.2
Lecture du cache
$0.1
Écriture du cache
Non indiqué

BaseTen

fp8
Contexte
1.0M
Sortie maximale
33K
Entrée
$0.5
Sortie
$1.2
Lecture du cache
$0.1
Écriture du cache
Non indiqué
thinkingmachines

3 modèles

Tous les modèles