qwen logo
qwen

Qwen: Qwen3.8 2.4T A95B (batch)

Qwen3.8 2.4T A95B is an open-weight sparse mixture-of-experts model from Qwen and the open-weight variant of Qwen3.8 Max, with 95 billion active parameters out of 2.4 trillion total. It is...

Visão geral

Especificações do modelo

Context
1.010.000 tokens
Saída máxima
909.000 tokens
Arquitetura
text->text
Tokenizador
Qwen
Limite de conhecimento
Not provided
Moderado
Não
Recursos e modalidades

InputOutput

Input
text
Output
text
Raciocínio

Sim · xhigh · medium · low

API

Parâmetros de API compatíveis

frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokensmin_ppresence_penaltyreasoningreasoning_effortrepetition_penaltyresponse_formatstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p
Provedores disponíveis

7 provedores

DeepInfra

fp4
Context
262K
Saída máxima
131K
Input
$2.00
Output
$6.00
Leitura de cache
$0.200
Gravação de cache
Not provided

Modal

unknown
Context
1M
Saída máxima
262K
Input
$2.00
Output
$6.00
Leitura de cache
$0.250
Gravação de cache
Not provided

Novita

unknown
Context
1M
Saída máxima
131K
Input
$2.00
Output
$6.00
Leitura de cache
$0.250
Gravação de cache
Not provided

SiliconFlow

fp8
Context
1.0M
Saída máxima
131K
Input
$2.00
Output
$6.00
Leitura de cache
$0.250
Gravação de cache
Not provided

Alibaba

unknown
Context
1M
Saída máxima
131K
Input
$2.00
Output
$6.00
Leitura de cache
$0.250
Gravação de cache
$2.50

Together

unknown
Context
1.0M
Saída máxima
909K
Input
$2.50
Output
$6.25
Leitura de cache
$0.500
Gravação de cache
Not provided

Venice

unknown
Context
262K
Saída máxima
66K
Input
$2.50
Output
$7.50
Leitura de cache
$0.313
Gravação de cache
Not provided