inclusionai logo
inclusionai

Ling-3.0-flash

Ling-3.0-flash is a 124B-parameter Mixture-of-Experts (MoE) model, with approximately 5.1B parameters activated per token. The model is designed with token efficiency and production-scale agentic inference as key priorities, enabling developers...

Resumen

Especificaciones del modelo

Context
262.144 tokens
Salida máxima
32.768 tokens
Arquitectura
text->text
Tokenizador
Other
Corte de conocimiento
Not provided
Moderado
No
Capacidades y modalidades

InputOutput

Input
text
Output
text
Razonamiento

API

Parámetros API compatibles

frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokensmin_ppresence_penaltyreasoningrepetition_penaltyresponse_formatseedstoptemperaturetool_choicetoolstop_ktop_logprobstop_p
Proveedores disponibles

2 proveedores

Novita

unknown
Context
262K
Salida máxima
33K
Input
$0.021
Output
$0.063
Lectura de caché
$0.0042
Escritura de caché
Not provided

DeepInfra

bf16
Context
131K
Salida máxima
33K
Input
$0.060
Output
$0.180
Lectura de caché
$0.012
Escritura de caché
Not provided
inclusionai

models

Todos los modelos