inclusionai logo
inclusionai

Ling-3.0-flash

Ling-3.0-flash is a 124B-parameter Mixture-of-Experts (MoE) model, with approximately 5.1B parameters activated per token. The model is designed with token efficiency and production-scale agentic inference as key priorities, enabling developers...

Panoramica

Specifiche del modello

Context
262.144 tokens
Output massimo
32.768 tokens
Architettura
text->text
Tokenizer
Other
Limite di conoscenza
Not provided
Moderato
No
Capacità e modalità

InputOutput

Input
text
Output
text
Ragionamento

API

Parametri API supportati

frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokensmin_ppresence_penaltyreasoningrepetition_penaltyresponse_formatseedstoptemperaturetool_choicetoolstop_ktop_logprobstop_p
Provider disponibili

2 provider

Novita

unknown
Context
262K
Output massimo
33K
Input
$0.021
Output
$0.063
Lettura cache
$0.0042
Scrittura cache
Not provided

DeepInfra

bf16
Context
131K
Output massimo
33K
Input
$0.060
Output
$0.180
Lettura cache
$0.012
Scrittura cache
Not provided
inclusionai

models

Tutti i modelli