qwen logo
qwen

Qwen: Qwen3.8 2.4T A95B

Descripción de la fuente (inglés)

Qwen3.8 2.4T A95B is an open-weight sparse mixture-of-experts model from Qwen and the open-weight variant of Qwen3.8 Max, with 95 billion active parameters out of 2.4 trillion total. It is...

Resumen

Especificaciones del modelo

Contexto
1.048.576 tokens
Salida máxima
131.072 tokens
Arquitectura
text->text
Tokenizador
Qwen
Corte de conocimiento
No indicado
Moderado
No
OPENROUTER

Precios completos

Tarifas sincronizadas desde OpenRouter, por millón de tokens.

Entrada
$2
por millón de tokens
Salida
$6
por millón de tokens
Lectura de caché
$0.25
por millón de tokens
API

Configuración del modelo

Parámetros predeterminados

temperature
1
top_p
0.95
top_k
20

Razonamiento

Razonamiento obligatorio
Parámetros predeterminados
xhigh
Capacidades y modalidades
xhigh, medium, low
API

Inicio rápido

Configura OPENROUTER_API_KEY localmente. Python requiere requests; JavaScript se ejecuta en Node.js. Mantén la clave en el servidor.

Documentación de la API

curl --fail-with-body https://openrouter.ai/api/v1/chat/completions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"qwen/qwen3.8-2.4t-a95b","messages":[{"role":"user","content":"Hello!"}]}'
Capacidades y modalidades

EntradaSalida

Entrada
text
Salida
text
Razonamiento

· xhigh · medium · low

API

Parámetros API compatibles

frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokensmin_ppresence_penaltyreasoningreasoning_effortrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p
Proveedores disponibles

7 proveedores

Verificado: 9 de septiembre de 2026

Proveedores en vivo en OpenRouter

Disponibilidad, latencia, rendimiento y enrutamiento cambian continuamente. Consulta la fuente para datos actuales.

OpenRouter

Novita

No indicado
Contexto
1M
Salida máxima
131K
Entrada
$2
Salida
$6
Lectura de caché
$0.25
Escritura de caché
No indicado

Alibaba

No indicado
Contexto
1M
Salida máxima
131K
Entrada
$2
Salida
$6
Lectura de caché
$0.25
Escritura de caché
$2.5

SiliconFlow

fp8
Contexto
1.0M
Salida máxima
131K
Entrada
$2
Salida
$6
Lectura de caché
$0.25
Escritura de caché
No indicado

Modal

No indicado
Contexto
1M
Salida máxima
262K
Entrada
$2
Salida
$6
Lectura de caché
$0.25
Escritura de caché
No indicado

DeepInfra

fp4
Contexto
262K
Salida máxima
131K
Entrada
$2
Salida
$6
Lectura de caché
$0.2
Escritura de caché
No indicado

Together

No indicado
Contexto
1.0M
Salida máxima
909K
Entrada
$2
Salida
$6
Lectura de caché
$0.25
Escritura de caché
No indicado

Venice

No indicado
Contexto
262K
Salida máxima
66K
Entrada
$2.5
Salida
$7.5
Lectura de caché
$0.3125
Escritura de caché
No indicado
qwen

4 modelos

Todos los modelos
qwen logoqwen

Qwen: Qwen3.8 Omni Flash

Qwen3.8 Omni Flash is an omni-modal reasoning model from Alibaba, the first Qwen model built around agentic capabilities with native audio-video understanding. It is suited for audio-video analysis and summarization,...

Contexto
1M
Entrada
text · image · audio · video
Salida
text
Entrada: $0.15Salida: $0.47por millón de tokens
Ver detalles del modelo
qwen logoqwen

Qwen: Qwen3.8 Max (0902)

Qwen3.8 Max 0902 is an updated snapshot of Qwen3.8 Max from Alibaba's Qwen team. It is a 2.4-trillion-parameter mixture-of-experts model that accepts text, image, and video input and returns text,...

Contexto
1M
Entrada
text · image · video
Salida
text
Entrada: $2Salida: $6por millón de tokens
Ver detalles del modelo
qwen logoqwen

Qwen: Qwen3.8 Flash

Qwen3.8 Flash is a multimodal reasoning model from Alibaba. It is suited for coding assistance, agentic workflows, visual understanding, document and codebase analysis, desktop interaction, chart analysis, and long-video analysis.

Contexto
1M
Entrada
text · image · video
Salida
text
Entrada: $0.15Salida: $0.47por millón de tokens
Ver detalles del modelo
qwen logoqwen

Qwen: Qwen3.8 27B

Qwen3.8 27B is an open-weight dense vision-language model from Qwen. It is suited for coding, professional workflows, research, multimodal interaction, and long-running agent tasks, with flexible thinking that can be...

Contexto
1M
Entrada
text · image · video
Salida
text
Entrada: $0.42Salida: $3por millón de tokens
Ver detalles del modelo