qwen logo
qwen

Qwen: Qwen3 ASR 0.6B

Opis źródłowy (angielski)

Qwen3 ASR 0.6B is a compact automatic speech recognition model from Qwen. It supports multilingual language identification and transcription across 30 languages and 22 Chinese dialects, with streaming and offline...

Przegląd

Specyfikacja modelu

Kontekst
Brak danych
Maksymalne wyjście
Brak danych
Architektura
audio->transcription
Tokenizer
Qwen3
Granica wiedzy
Brak danych
Moderowany
Nie
OPENROUTER

Pełny cennik

Stawki zsynchronizowane z OpenRouter, za milion tokenów.

Czas audio
$0.000003
za sekundę
API

Szybki start

Ustaw lokalnie OPENROUTER_API_KEY. Python wymaga requests, a JavaScript działa w Node.js. Klucz przechowuj na serwerze.

Dokumentacja API

curl --fail-with-body https://openrouter.ai/api/v1/audio/transcriptions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -F 'model=qwen/qwen3-asr-0.6b' \
  -F 'file=@audio.wav'
Możliwości i modalności

WejścieWyjście

Wejście
audio
Wyjście
transcription
API

Obsługiwane parametry API

Dostępni dostawcy

1 Dostawca

Sprawdzono: 16 września 2026

Dostawcy na żywo w OpenRouter

Dostępność, opóźnienie, przepustowość i routing stale się zmieniają. Aktualne dane są na stronie źródłowej.

OpenRouter

DeepInfra

Brak danych
Kontekst
Brak danych
Maksymalne wyjście
Brak danych
qwen

4 modele

Wszystkie modele
qwen logoqwen

Qwen: Qwen3.8 Omni Flash

Qwen3.8 Omni Flash is an omni-modal reasoning model from Alibaba, the first Qwen model built around agentic capabilities with native audio-video understanding. It is suited for audio-video analysis and summarization,...

Kontekst
1M
Wejście
text · image · audio · video
Wyjście
text
Wejście: $0.15Wyjście: $0.47za milion tokenów
Zobacz szczegóły modelu
qwen logoqwen

Qwen: Qwen3.8 Max (0902)

Qwen3.8 Max 0902 is an updated snapshot of Qwen3.8 Max from Alibaba's Qwen team. It is a 2.4-trillion-parameter mixture-of-experts model that accepts text, image, and video input and returns text,...

Kontekst
1M
Wejście
text · image · video
Wyjście
text
Wejście: $2Wyjście: $6za milion tokenów
Zobacz szczegóły modelu
qwen logoqwen

Qwen: Qwen3.8 Flash

Qwen3.8 Flash is a multimodal reasoning model from Alibaba. It is suited for coding assistance, agentic workflows, visual understanding, document and codebase analysis, desktop interaction, chart analysis, and long-video analysis.

Kontekst
1M
Wejście
text · image · video
Wyjście
text
Wejście: $0.15Wyjście: $0.47za milion tokenów
Zobacz szczegóły modelu
qwen logoqwen

Qwen: Qwen3.8 27B

Qwen3.8 27B is an open-weight dense vision-language model from Qwen. It is suited for coding, professional workflows, research, multimodal interaction, and long-running agent tasks, with flexible thinking that can be...

Kontekst
1M
Wejście
text · image · video
Wyjście
text
Wejście: $0.42Wyjście: $3za milion tokenów
Zobacz szczegóły modelu