qwen logo
qwen

Qwen: Qwen3.5-27B

The Qwen3.5 27B native vision-language Dense model incorporates a linear attention mechanism, delivering fast response times while balancing inference speed and performance. $0.195 per million input tokens, $1.56 per million output tokens. 262,144 token context window, maximum output of 65,536 tokens. Higher uptime with 6 providers. Includes independent benchmarks from Artificial Analysis.

Resumen

Especificaciones del modelo

Contexto
262.144 tokens
Salida máxima
65.536 tokens
Arquitectura
text+image+video->text
Tokenizador
Qwen3
Corte de conocimiento
No indicado
Moderado
No
OPENROUTER

Precios completos

Tarifas sincronizadas desde OpenRouter, por millón de tokens.

Entrada
$0.195
/M tokens
Salida
$1.56
/M tokens
API

Configuración del modelo

Parámetros predeterminados

temperature
0.6
top_p
0.95
top_k
20

Razonamiento

Moderado
No
Parámetros predeterminados
No
API

Inicio rápido

Usa este modelo mediante la API compatible con OpenAI de OpenRouter.

curl https://openrouter.ai/api/v1/chat/completions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"qwen/qwen3.5-27b","messages":[{"role":"user","content":"Hello!"}]}'
Capacidades y modalidades

EntradaSalida

Entrada
textimagevideo
Salida
text
Razonamiento

No

API

Parámetros API compatibles

frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokensmin_ppresence_penaltyreasoningrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p
Proveedores disponibles

6 proveedores

Proveedores en vivo en OpenRouter

Disponibilidad, latencia, rendimiento y enrutamiento cambian continuamente. Consulta la fuente para datos actuales.

OpenRouter

Alibaba

unknown
Contexto
262K
Salida máxima
66K
Entrada
$0.195
Salida
$1.56
Lectura de caché
No indicado
Escritura de caché
No indicado

SiliconFlow

fp8
Contexto
262K
Salida máxima
236K
Entrada
$0.250
Salida
$2.00
Lectura de caché
No indicado
Escritura de caché
No indicado

DeepInfra

fp8
Contexto
262K
Salida máxima
82K
Entrada
$0.260
Salida
$2.60
Lectura de caché
No indicado
Escritura de caché
No indicado

AtlasCloud

fp8
Contexto
262K
Salida máxima
66K
Entrada
$0.270
Salida
$2.16
Lectura de caché
$0.270
Escritura de caché
No indicado

Phala

unknown
Contexto
262K
Salida máxima
66K
Entrada
$0.300
Salida
$2.40
Lectura de caché
$0.150
Escritura de caché
No indicado

Novita

bf16
Contexto
262K
Salida máxima
66K
Entrada
$0.300
Salida
$2.40
Lectura de caché
No indicado
Escritura de caché
No indicado
qwen logoqwen

Qwen: Qwen3.8 Flash

Qwen3.8 Flash is a multimodal reasoning model from Alibaba. It is suited for coding assistance, agentic workflows, visual understanding, document and codebase analysis, desktop interaction, chart analysis, and long-video analysis.

Contexto
1M
Entrada
text · image · video
Salida
text
Entrada: $0.150Salida: $0.470por millón de tokens
Ver detalles del modelo
qwen logoqwen

Qwen: Qwen3.8 27B

Qwen3.8 27B is an open-weight dense vision-language model from Qwen. It is suited for coding, professional workflows, research, multimodal interaction, and long-running agent tasks, with flexible thinking that can be...

Contexto
1M
Entrada
text · image · video
Salida
text
Entrada: $0.425Salida: $2.55por millón de tokens
Ver detalles del modelo
qwen logoqwen

Qwen3 Reranker 8B

Qwen3 Reranker 8B is a text reranking model from Alibaba Cloud built on the Qwen3 architecture. It evaluates query-document pairs to produce relevance scores for use in retrieval and RAG...

Contexto
41K
Entrada
text
Salida
rerank
Entrada: GratisSalida: Gratispor millón de tokens
Ver detalles del modelo
qwen logoqwen

Qwen: Qwen3 ASR 1.7B

Qwen3 ASR 1.7B is an automatic speech recognition model from Qwen. It supports multilingual language identification and transcription across 30 languages and 22 Chinese dialects, with streaming and offline inference...

Contexto
No indicado
Entrada
audio
Salida
transcription
Entrada: $7.50Salida: Gratispor millón de tokens
Ver detalles del modelo