qwen logo
qwen

Qwen: Qwen3.5 397B A17B

Descrizione della fonte (inglese)

The Qwen3.5 series 397B-A17B native vision-language model is built on a hybrid architecture that integrates a linear attention mechanism with a sparse mixture-of-experts model, achieving higher inference efficiency. It delivers...

Panoramica

Specifiche del modello

Contesto
262.144 tokens
Output massimo
235.929 tokens
Architettura
text+image+video->text
Tokenizer
Qwen3
Limite di conoscenza
Non indicato
Moderato
No
OPENROUTER

Prezzi completi

Tariffe sincronizzate da OpenRouter, per milione di token.

Input
$0.55
per milione di token
Output
$3.5
per milione di token
Lettura cache
$0.225
per milione di token
API

Configurazione del modello

Parametri predefiniti

temperature
0.6
top_p
0.95
top_k
20

Ragionamento

Ragionamento obbligatorio
No
Parametri predefiniti
No
API

Avvio rapido

Imposta OPENROUTER_API_KEY localmente. Python richiede requests; JavaScript viene eseguito in Node.js. Conserva la chiave sul server.

Documentazione API

curl --fail-with-body https://openrouter.ai/api/v1/chat/completions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"qwen/qwen3.5-397b-a17b","messages":[{"role":"user","content":"Hello!"}]}'
Capacità e modalità

InputOutput

Input
textimagevideo
Output
text
Ragionamento

No

API

Parametri API supportati

frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokensmin_ppresence_penaltyreasoningrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p
Provider disponibili

10 provider

Verificato: 9 settembre 2026

Provider live su OpenRouter

Disponibilità, latenza, throughput e routing cambiano continuamente. Consulta la fonte per i dati correnti.

OpenRouter

Alibaba

Non indicato
Contesto
262K
Output massimo
66K
Input
$0.39
Output
$2.34
Lettura cache
Non indicato
Scrittura cache
Non indicato

DeepInfra

fp8
Contesto
262K
Output massimo
82K
Input
$0.45
Output
$3
Lettura cache
$0.22
Scrittura cache
Non indicato

Parasail

fp8
Contesto
262K
Output massimo
236K
Input
$0.5
Output
$3.6
Lettura cache
$0.3
Scrittura cache
Non indicato

DigitalOcean

Non indicato
Contesto
131K
Output massimo
118K
Input
$0.55
Output
$3.5
Lettura cache
$0.111
Scrittura cache
Non indicato

Phala

Non indicato
Contesto
262K
Output massimo
236K
Input
$0.55
Output
$3.5
Lettura cache
$0.225
Scrittura cache
Non indicato

AtlasCloud

fp8
Contesto
262K
Output massimo
66K
Input
$0.55
Output
$3.5
Lettura cache
$0.55
Scrittura cache
Non indicato

StreamLake

Non indicato
Contesto
256K
Output massimo
64K
Input
$0.6
Output
$3.6
Lettura cache
$0.12
Scrittura cache
Non indicato

GMICloud

fp8
Contesto
262K
Output massimo
236K
Input
$0.6
Output
$3.6
Lettura cache
Non indicato
Scrittura cache
Non indicato

Novita

Non indicato
Contesto
262K
Output massimo
66K
Input
$0.6
Output
$3.6
Lettura cache
Non indicato
Scrittura cache
Non indicato

Venice

Non indicato
Contesto
128K
Output massimo
33K
Input
$0.75
Output
$4.5
Lettura cache
Non indicato
Scrittura cache
Non indicato
qwen

4 modelli

Tutti i modelli
qwen logoqwen

Qwen: Qwen3.8 Omni Flash

Qwen3.8 Omni Flash is an omni-modal reasoning model from Alibaba, the first Qwen model built around agentic capabilities with native audio-video understanding. It is suited for audio-video analysis and summarization,...

Contesto
1M
Input
text · image · audio · video
Output
text
Input: $0.15Output: $0.47per milione di token
Vedi i dettagli del modello
qwen logoqwen

Qwen: Qwen3.8 Max (0902)

Qwen3.8 Max 0902 is an updated snapshot of Qwen3.8 Max from Alibaba's Qwen team. It is a 2.4-trillion-parameter mixture-of-experts model that accepts text, image, and video input and returns text,...

Contesto
1M
Input
text · image · video
Output
text
Input: $2Output: $6per milione di token
Vedi i dettagli del modello
qwen logoqwen

Qwen: Qwen3.8 Flash

Qwen3.8 Flash is a multimodal reasoning model from Alibaba. It is suited for coding assistance, agentic workflows, visual understanding, document and codebase analysis, desktop interaction, chart analysis, and long-video analysis.

Contesto
1M
Input
text · image · video
Output
text
Input: $0.15Output: $0.47per milione di token
Vedi i dettagli del modello
qwen logoqwen

Qwen: Qwen3.8 27B

Qwen3.8 27B is an open-weight dense vision-language model from Qwen. It is suited for coding, professional workflows, research, multimodal interaction, and long-running agent tasks, with flexible thinking that can be...

Contesto
1M
Input
text · image · video
Output
text
Input: $0.42Output: $3per milione di token
Vedi i dettagli del modello