qwen logo
qwen

Qwen: Qwen3.5-9B

Qwen3.5-9B is a multimodal foundation model from the Qwen3.5 family, designed to deliver strong reasoning, coding, and visual understanding in an efficient 9B-parameter architecture. $0.10 per million input tokens, $0.15 per million output tokens. 262,144 token context window, maximum output of 81,920 tokens. Higher uptime with 5 providers. Includes independent benchmarks from Artificial Analysis.

Przegląd

Specyfikacja modelu

Kontekst
262 144 tokens
Maksymalne wyjście
235 929 tokens
Architektura
text+image+video->text
Tokenizer
Qwen3
Granica wiedzy
Brak danych
Moderowany
Nie
OPENROUTER

Pełny cennik

Stawki zsynchronizowane z OpenRouter, za milion tokenów.

Wejście
$0.1
/M tokens
Wyjście
$0.15
/M tokens
API

Konfiguracja modelu

Rozumowanie

Moderowany
Nie
Parametry domyślne
Nie
API

Szybki start

Wywołaj ten model przez zgodne z OpenAI API OpenRouter.

curl https://openrouter.ai/api/v1/chat/completions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"qwen/qwen3.5-9b","messages":[{"role":"user","content":"Hello!"}]}'
Możliwości i modalności

WejścieWyjście

Wejście
textimagevideo
Wyjście
text
Rozumowanie

Nie

API

Obsługiwane parametry API

frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokensmin_ppresence_penaltyreasoningrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p
Dostępni dostawcy

5 dostawców

Dostawcy na żywo w OpenRouter

Dostępność, opóźnienie, przepustowość i routing stale się zmieniają. Aktualne dane są na stronie źródłowej.

OpenRouter

DeepInfra

bf16
Kontekst
262K
Maksymalne wyjście
82K
Wejście
$0.100
Wyjście
$0.150
Odczyt pamięci podręcznej
Brak danych
Zapis pamięci podręcznej
Brak danych

SiliconFlow

fp8
Kontekst
262K
Maksymalne wyjście
236K
Wejście
$0.100
Wyjście
$0.150
Odczyt pamięci podręcznej
Brak danych
Zapis pamięci podręcznej
Brak danych

Venice

fp8
Kontekst
256K
Maksymalne wyjście
33K
Wejście
$0.100
Wyjście
$0.150
Odczyt pamięci podręcznej
Brak danych
Zapis pamięci podręcznej
Brak danych

Parasail

bf16
Kontekst
262K
Maksymalne wyjście
236K
Wejście
$0.100
Wyjście
$0.250
Odczyt pamięci podręcznej
Brak danych
Zapis pamięci podręcznej
Brak danych

Together

unknown
Kontekst
262K
Maksymalne wyjście
236K
Wejście
$0.170
Wyjście
$0.250
Odczyt pamięci podręcznej
Brak danych
Zapis pamięci podręcznej
Brak danych
qwen logoqwen

Qwen: Qwen3.8 Flash

Qwen3.8 Flash is a multimodal reasoning model from Alibaba. It is suited for coding assistance, agentic workflows, visual understanding, document and codebase analysis, desktop interaction, chart analysis, and long-video analysis.

Kontekst
1M
Wejście
text · image · video
Wyjście
text
Wejście: $0.150Wyjście: $0.470za milion tokenów
Zobacz szczegóły modelu
qwen logoqwen

Qwen: Qwen3.8 27B

Qwen3.8 27B is an open-weight dense vision-language model from Qwen. It is suited for coding, professional workflows, research, multimodal interaction, and long-running agent tasks, with flexible thinking that can be...

Kontekst
1M
Wejście
text · image · video
Wyjście
text
Wejście: $0.425Wyjście: $2.55za milion tokenów
Zobacz szczegóły modelu
qwen logoqwen

Qwen3 Reranker 8B

Qwen3 Reranker 8B is a text reranking model from Alibaba Cloud built on the Qwen3 architecture. It evaluates query-document pairs to produce relevance scores for use in retrieval and RAG...

Kontekst
41K
Wejście
text
Wyjście
rerank
Wejście: BezpłatnieWyjście: Bezpłatnieza milion tokenów
Zobacz szczegóły modelu
qwen logoqwen

Qwen: Qwen3 ASR 1.7B

Qwen3 ASR 1.7B is an automatic speech recognition model from Qwen. It supports multilingual language identification and transcription across 30 languages and 22 Chinese dialects, with streaming and offline inference...

Kontekst
Brak danych
Wejście
audio
Wyjście
transcription
Wejście: $7.50Wyjście: Bezpłatnieza milion tokenów
Zobacz szczegóły modelu