qwen logo
qwen

Qwen: Qwen3.5 397B A17B

The Qwen3.5 series 397B-A17B native vision-language model is built on a hybrid architecture that integrates a linear attention mechanism with a sparse mixture-of-experts model, achieving higher inference efficiency. $0.39 per million input tokens, $2.34 per million output tokens. 262,144 token context window, maximum output of 65,536 tokens. Higher uptime with 10 providers. Includes independent benchmarks from Artificial Analysis.

Visão geral

Especificações do modelo

Contexto
262.144 tokens
Saída máxima
65.536 tokens
Arquitetura
text+image+video->text
Tokenizador
Qwen3
Limite de conhecimento
Não informado
Moderado
Não
OPENROUTER

Preços completos

Tarifas sincronizadas do OpenRouter, por milhão de tokens.

Entrada
$0.39
/M tokens
Saída
$2.34
/M tokens
API

Configuração do modelo

Parâmetros padrão

temperature
0.6
top_p
0.95
top_k
20

Raciocínio

Moderado
Não
Parâmetros padrão
Não
API

Início rápido

Use este modelo pela API compatível com OpenAI do OpenRouter.

curl https://openrouter.ai/api/v1/chat/completions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"qwen/qwen3.5-397b-a17b","messages":[{"role":"user","content":"Hello!"}]}'
Recursos e modalidades

EntradaSaída

Entrada
textimagevideo
Saída
text
Raciocínio

Não

API

Parâmetros de API compatíveis

frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokensmin_ppresence_penaltyreasoningrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p
Provedores disponíveis

10 provedores

Provedores ao vivo no OpenRouter

Disponibilidade, latência, throughput e roteamento mudam continuamente. Consulte a fonte para dados atuais.

OpenRouter

Alibaba

unknown
Contexto
262K
Saída máxima
66K
Entrada
$0.390
Saída
$2.34
Leitura de cache
Não informado
Gravação de cache
Não informado

DeepInfra

fp8
Contexto
262K
Saída máxima
82K
Entrada
$0.450
Saída
$3.00
Leitura de cache
$0.220
Gravação de cache
Não informado

Parasail

fp8
Contexto
262K
Saída máxima
236K
Entrada
$0.500
Saída
$3.60
Leitura de cache
$0.300
Gravação de cache
Não informado

DigitalOcean

unknown
Contexto
131K
Saída máxima
118K
Entrada
$0.550
Saída
$3.50
Leitura de cache
$0.111
Gravação de cache
Não informado

AtlasCloud

fp8
Contexto
262K
Saída máxima
66K
Entrada
$0.550
Saída
$3.50
Leitura de cache
$0.550
Gravação de cache
Não informado

Phala

unknown
Contexto
262K
Saída máxima
236K
Entrada
$0.550
Saída
$3.50
Leitura de cache
$0.225
Gravação de cache
Não informado

Novita

unknown
Contexto
262K
Saída máxima
66K
Entrada
$0.600
Saída
$3.60
Leitura de cache
Não informado
Gravação de cache
Não informado

GMICloud

fp8
Contexto
262K
Saída máxima
236K
Entrada
$0.600
Saída
$3.60
Leitura de cache
Não informado
Gravação de cache
Não informado

StreamLake

unknown
Contexto
256K
Saída máxima
64K
Entrada
$0.600
Saída
$3.60
Leitura de cache
$0.120
Gravação de cache
Não informado

Venice

unknown
Contexto
128K
Saída máxima
33K
Entrada
$0.750
Saída
$4.50
Leitura de cache
Não informado
Gravação de cache
Não informado
qwen logoqwen

Qwen: Qwen3.8 Flash

Qwen3.8 Flash is a multimodal reasoning model from Alibaba. It is suited for coding assistance, agentic workflows, visual understanding, document and codebase analysis, desktop interaction, chart analysis, and long-video analysis.

Contexto
1M
Entrada
text · image · video
Saída
text
Entrada: $0.150Saída: $0.470por milhão de tokens
Ver detalhes do modelo
qwen logoqwen

Qwen: Qwen3.8 27B

Qwen3.8 27B is an open-weight dense vision-language model from Qwen. It is suited for coding, professional workflows, research, multimodal interaction, and long-running agent tasks, with flexible thinking that can be...

Contexto
1M
Entrada
text · image · video
Saída
text
Entrada: $0.425Saída: $2.55por milhão de tokens
Ver detalhes do modelo
qwen logoqwen

Qwen3 Reranker 8B

Qwen3 Reranker 8B is a text reranking model from Alibaba Cloud built on the Qwen3 architecture. It evaluates query-document pairs to produce relevance scores for use in retrieval and RAG...

Contexto
41K
Entrada
text
Saída
rerank
Entrada: GrátisSaída: Grátispor milhão de tokens
Ver detalhes do modelo
qwen logoqwen

Qwen: Qwen3 ASR 1.7B

Qwen3 ASR 1.7B is an automatic speech recognition model from Qwen. It supports multilingual language identification and transcription across 30 languages and 22 Chinese dialects, with streaming and offline inference...

Contexto
Não informado
Entrada
audio
Saída
transcription
Entrada: $7.50Saída: Grátispor milhão de tokens
Ver detalhes do modelo