qwen logo
qwen

Qwen: Qwen3.8 2.4T A95B

Descrição da fonte (inglês)

Qwen3.8 2.4T A95B is an open-weight sparse mixture-of-experts model from Qwen and the open-weight variant of Qwen3.8 Max, with 95 billion active parameters out of 2.4 trillion total. It is...

Visão geral

Especificações do modelo

Contexto
1.048.576 tokens
Saída máxima
131.072 tokens
Arquitetura
text->text
Tokenizador
Qwen
Limite de conhecimento
Não informado
Moderado
Não
OPENROUTER

Preços completos

Tarifas sincronizadas do OpenRouter, por milhão de tokens.

Entrada
$2
por milhão de tokens
Saída
$6
por milhão de tokens
Leitura de cache
$0.25
por milhão de tokens
API

Configuração do modelo

Parâmetros padrão

temperature
1
top_p
0.95
top_k
20

Raciocínio

Raciocínio obrigatório
Sim
Parâmetros padrão
xhigh
Recursos e modalidades
xhigh, medium, low
API

Início rápido

Defina OPENROUTER_API_KEY localmente. Python requer requests; JavaScript roda em Node.js. Mantenha a chave no servidor.

Documentação da API

curl --fail-with-body https://openrouter.ai/api/v1/chat/completions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"qwen/qwen3.8-2.4t-a95b","messages":[{"role":"user","content":"Hello!"}]}'
Recursos e modalidades

EntradaSaída

Entrada
text
Saída
text
Raciocínio

Sim · xhigh · medium · low

API

Parâmetros de API compatíveis

frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokensmin_ppresence_penaltyreasoningreasoning_effortrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p
Provedores disponíveis

7 provedores

Verificado: 9 de setembro de 2026

Provedores ao vivo no OpenRouter

Disponibilidade, latência, throughput e roteamento mudam continuamente. Consulte a fonte para dados atuais.

OpenRouter

Novita

Não informado
Contexto
1M
Saída máxima
131K
Entrada
$2
Saída
$6
Leitura de cache
$0.25
Gravação de cache
Não informado

Alibaba

Não informado
Contexto
1M
Saída máxima
131K
Entrada
$2
Saída
$6
Leitura de cache
$0.25
Gravação de cache
$2.5

SiliconFlow

fp8
Contexto
1.0M
Saída máxima
131K
Entrada
$2
Saída
$6
Leitura de cache
$0.25
Gravação de cache
Não informado

Modal

Não informado
Contexto
1M
Saída máxima
262K
Entrada
$2
Saída
$6
Leitura de cache
$0.25
Gravação de cache
Não informado

DeepInfra

fp4
Contexto
262K
Saída máxima
131K
Entrada
$2
Saída
$6
Leitura de cache
$0.2
Gravação de cache
Não informado

Together

Não informado
Contexto
1.0M
Saída máxima
909K
Entrada
$2
Saída
$6
Leitura de cache
$0.25
Gravação de cache
Não informado

Venice

Não informado
Contexto
262K
Saída máxima
66K
Entrada
$2.5
Saída
$7.5
Leitura de cache
$0.3125
Gravação de cache
Não informado
qwen

4 modelos

Todos os modelos
qwen logoqwen

Qwen: Qwen3.8 Omni Flash

Qwen3.8 Omni Flash is an omni-modal reasoning model from Alibaba, the first Qwen model built around agentic capabilities with native audio-video understanding. It is suited for audio-video analysis and summarization,...

Contexto
1M
Entrada
text · image · audio · video
Saída
text
Entrada: $0.15Saída: $0.47por milhão de tokens
Ver detalhes do modelo
qwen logoqwen

Qwen: Qwen3.8 Max (0902)

Qwen3.8 Max 0902 is an updated snapshot of Qwen3.8 Max from Alibaba's Qwen team. It is a 2.4-trillion-parameter mixture-of-experts model that accepts text, image, and video input and returns text,...

Contexto
1M
Entrada
text · image · video
Saída
text
Entrada: $2Saída: $6por milhão de tokens
Ver detalhes do modelo
qwen logoqwen

Qwen: Qwen3.8 Flash

Qwen3.8 Flash is a multimodal reasoning model from Alibaba. It is suited for coding assistance, agentic workflows, visual understanding, document and codebase analysis, desktop interaction, chart analysis, and long-video analysis.

Contexto
1M
Entrada
text · image · video
Saída
text
Entrada: $0.15Saída: $0.47por milhão de tokens
Ver detalhes do modelo
qwen logoqwen

Qwen: Qwen3.8 27B

Qwen3.8 27B is an open-weight dense vision-language model from Qwen. It is suited for coding, professional workflows, research, multimodal interaction, and long-running agent tasks, with flexible thinking that can be...

Contexto
1M
Entrada
text · image · video
Saída
text
Entrada: $0.42Saída: $3por milhão de tokens
Ver detalhes do modelo