inclusionai logo
inclusionai

Ling-3.0-flash

Ling-3.0-flash is a 124B-parameter Mixture-of-Experts (MoE) model, with approximately 5.1B parameters activated per token. The model is designed with token efficiency and production-scale agentic inference as key priorities, enabling developers...

Présentation

Caractéristiques du modèle

Context
262 144 tokens
Sortie maximale
32 768 tokens
Architecture
text->text
Tokenizer
Other
Limite des connaissances
Not provided
Modéré
Non
Capacités et modalités

InputOutput

Input
text
Output
text
Raisonnement

Oui

API

Paramètres API pris en charge

frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokensmin_ppresence_penaltyreasoningrepetition_penaltyresponse_formatseedstoptemperaturetool_choicetoolstop_ktop_logprobstop_p
Fournisseurs disponibles

2 fournisseurs

Novita

unknown
Context
262K
Sortie maximale
33K
Input
$0.021
Output
$0.063
Lecture du cache
$0.0042
Écriture du cache
Not provided

DeepInfra

bf16
Context
131K
Sortie maximale
33K
Input
$0.060
Output
$0.180
Lecture du cache
$0.012
Écriture du cache
Not provided
inclusionai

models

Tous les modèles