inclusionai logo
inclusionai

Ling-3.0-flash

Ling-3.0-flash is a 124B-parameter Mixture-of-Experts (MoE) model, with approximately 5.1B parameters activated per token. The model is designed with token efficiency and production-scale agentic inference as key priorities, enabling developers...

Visão geral

Especificações do modelo

Context
262.144 tokens
Saída máxima
32.768 tokens
Arquitetura
text->text
Tokenizador
Other
Limite de conhecimento
Not provided
Moderado
Não
Recursos e modalidades

InputOutput

Input
text
Output
text
Raciocínio

Sim

API

Parâmetros de API compatíveis

frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokensmin_ppresence_penaltyreasoningrepetition_penaltyresponse_formatseedstoptemperaturetool_choicetoolstop_ktop_logprobstop_p
Provedores disponíveis

2 provedores

Novita

unknown
Context
262K
Saída máxima
33K
Input
$0.021
Output
$0.063
Leitura de cache
$0.0042
Gravação de cache
Not provided

DeepInfra

bf16
Context
131K
Saída máxima
33K
Input
$0.060
Output
$0.180
Leitura de cache
$0.012
Gravação de cache
Not provided
inclusionai

models

Todos os modelos