thinkingmachines logo
thinkingmachines

Thinking Machines: Inkling Small

Descrição da fonte (inglês)

Inkling Small is an open-weight multimodal mixture-of-experts model from Thinking Machines Lab, with 12B active parameters out of 276B total. It is positioned as the smaller, more efficient member of...

Visão geral

Especificações do modelo

Contexto
1.048.576 tokens
Saída máxima
262.144 tokens
Arquitetura
text+image+audio->text
Tokenizador
Other
Limite de conhecimento
Não informado
Moderado
Não
OPENROUTER

Preços completos

Tarifas sincronizadas do OpenRouter, por milhão de tokens.

Entrada
$0.45
por milhão de tokens
Saída
$1.2
por milhão de tokens
Leitura de cache
$0.1
por milhão de tokens
API

Configuração do modelo

Raciocínio

Raciocínio obrigatório
Não
Parâmetros padrão
high
Recursos e modalidades
max, high, medium, low, minimal, none
API

Início rápido

Defina OPENROUTER_API_KEY localmente. Python requer requests; JavaScript roda em Node.js. Mantenha a chave no servidor.

Documentação da API

curl --fail-with-body https://openrouter.ai/api/v1/chat/completions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"thinkingmachines/inkling-small","messages":[{"role":"user","content":"Hello!"}]}'
Recursos e modalidades

EntradaSaída

Entrada
textimageaudio
Saída
text
Raciocínio

Sim · max · high · medium · low · minimal · none

API

Parâmetros de API compatíveis

frequency_penaltyinclude_reasoninglogit_biasmax_tokensmin_ppresence_penaltyreasoningreasoning_effortrepetition_penaltyseedstoptemperaturetool_choicetoolstop_ktop_p
Provedores disponíveis

2 provedores

Verificado: 23 de setembro de 2026

Provedores ao vivo no OpenRouter

Disponibilidade, latência, throughput e roteamento mudam continuamente. Consulte a fonte para dados atuais.

OpenRouter

DeepInfra

fp8
Contexto
524K
Saída máxima
262K
Entrada
$0.45
Saída
$1.2
Leitura de cache
$0.1
Gravação de cache
Não informado

BaseTen

fp8
Contexto
1.0M
Saída máxima
33K
Entrada
$0.5
Saída
$1.2
Leitura de cache
$0.1
Gravação de cache
Não informado
thinkingmachines

3 modelos

Todos os modelos