qwen logo
qwen

Qwen: Qwen3 ASR 1.7B

Descripción de la fuente (inglés)

Qwen3 ASR 1.7B is an automatic speech recognition model from Qwen. It supports multilingual language identification and transcription across 30 languages and 22 Chinese dialects, with streaming and offline inference...

Resumen

Especificaciones del modelo

Contexto
No indicado
Salida máxima
No indicado
Arquitectura
audio->transcription
Tokenizador
Qwen3
Corte de conocimiento
No indicado
Moderado
No
OPENROUTER

Precios completos

Tarifas sincronizadas desde OpenRouter, por millón de tokens.

Duración del audio
$0.000008
por segundo
API

Inicio rápido

Configura OPENROUTER_API_KEY localmente. Python requiere requests; JavaScript se ejecuta en Node.js. Mantén la clave en el servidor.

Documentación de la API

curl --fail-with-body https://openrouter.ai/api/v1/audio/transcriptions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -F 'model=qwen/qwen3-asr-1.7b' \
  -F 'file=@audio.wav'
Capacidades y modalidades

EntradaSalida

Entrada
audio
Salida
transcription
API

Parámetros API compatibles

Proveedores disponibles

1 Proveedor

Verificado: 16 de septiembre de 2026

Proveedores en vivo en OpenRouter

Disponibilidad, latencia, rendimiento y enrutamiento cambian continuamente. Consulta la fuente para datos actuales.

OpenRouter

DeepInfra

No indicado
Contexto
No indicado
Salida máxima
No indicado
qwen

4 modelos

Todos los modelos
qwen logoqwen

Qwen: Qwen3.8 Omni Flash

Qwen3.8 Omni Flash is an omni-modal reasoning model from Alibaba, the first Qwen model built around agentic capabilities with native audio-video understanding. It is suited for audio-video analysis and summarization,...

Contexto
1M
Entrada
text · image · audio · video
Salida
text
Entrada: $0.15Salida: $0.47por millón de tokens
Ver detalles del modelo
qwen logoqwen

Qwen: Qwen3.8 Max (0902)

Qwen3.8 Max 0902 is an updated snapshot of Qwen3.8 Max from Alibaba's Qwen team. It is a 2.4-trillion-parameter mixture-of-experts model that accepts text, image, and video input and returns text,...

Contexto
1M
Entrada
text · image · video
Salida
text
Entrada: $2Salida: $6por millón de tokens
Ver detalles del modelo
qwen logoqwen

Qwen: Qwen3.8 Flash

Qwen3.8 Flash is a multimodal reasoning model from Alibaba. It is suited for coding assistance, agentic workflows, visual understanding, document and codebase analysis, desktop interaction, chart analysis, and long-video analysis.

Contexto
1M
Entrada
text · image · video
Salida
text
Entrada: $0.15Salida: $0.47por millón de tokens
Ver detalles del modelo
qwen logoqwen

Qwen: Qwen3.8 27B

Qwen3.8 27B is an open-weight dense vision-language model from Qwen. It is suited for coding, professional workflows, research, multimodal interaction, and long-running agent tasks, with flexible thinking that can be...

Contexto
1M
Entrada
text · image · video
Salida
text
Entrada: $0.42Salida: $3por millón de tokens
Ver detalles del modelo