thinkingmachines logo
thinkingmachines

Thinking Machines: Inkling

Beschreibung der Quelle (Englisch)

Inkling is an open-weight multimodal mixture-of-experts model from Thinking Machines Lab, with 41B active parameters out of 975B total. It is designed for general-purpose reasoning, coding, agentic and tool-use systems,...

Überblick

Modellspezifikationen

Kontext
1.048.576 tokens
Maximale Ausgabe
471.859 tokens
Architektur
text+image+audio->text
Tokenizer
Other
Wissensstand
Nicht angegeben
Moderiert
Nein
OPENROUTER

Vollständige Preise

Mit OpenRouter synchronisierte Preise; Tokenpreise gelten pro eine Million Token.

Eingabe
$1
pro 1 Mio. Token
Ausgabe
$4.05
pro 1 Mio. Token
Cache-Lesen
$0.17
pro 1 Mio. Token
API

Modellkonfiguration

Schlussfolgern

Reasoning erforderlich
Nein
Standardparameter
high
Fähigkeiten und Modalitäten
max, high, medium, low, minimal, none
API

Schnellstart

Setzen Sie OPENROUTER_API_KEY lokal. Python benötigt requests; JavaScript läuft in Node.js. Bewahren Sie den Schlüssel auf dem Server auf.

API-Dokumentation

curl --fail-with-body https://openrouter.ai/api/v1/chat/completions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"thinkingmachines/inkling","messages":[{"role":"user","content":"Hello!"}]}'
Fähigkeiten und Modalitäten

EingabeAusgabe

Eingabe
textimageaudio
Ausgabe
text
Schlussfolgern

Ja · max · high · medium · low · minimal · none

API

Unterstützte API-Parameter

frequency_penaltyinclude_reasoninglogit_biasmax_tokensmin_ppresence_penaltyreasoningreasoning_effortrepetition_penaltyseedstoptemperaturetool_choicetoolstop_ktop_p
Verfügbare Anbieter

4 Anbieter

Geprüft: 15. September 2026

Live-Anbieter bei OpenRouter

Verfügbarkeit, Latenz, Durchsatz und Routing ändern sich laufend. Aktuelle Betriebsdaten stehen auf der Quellseite.

OpenRouter

DeepInfra

fp8
Kontext
524K
Maximale Ausgabe
262K
Eingabe
$0.95
Ausgabe
$4.05
Cache-Lesen
$0.16
Cache-Schreiben
Nicht angegeben

BaseTen

fp8
Kontext
1.0M
Maximale Ausgabe
33K
Eingabe
$1
Ausgabe
$4.05
Cache-Lesen
$0.17
Cache-Schreiben
Nicht angegeben

Together

Nicht angegeben
Kontext
524K
Maximale Ausgabe
472K
Eingabe
$1
Ausgabe
$4.05
Cache-Lesen
$0.17
Cache-Schreiben
Nicht angegeben

BaseTen

fp8
Kontext
1.0M
Maximale Ausgabe
33K
Eingabe
$1
Ausgabe
$4.05
Cache-Lesen
$0.17
Cache-Schreiben
Nicht angegeben
thinkingmachines

3 Modelle

Alle Modelle