qwen logo
qwen

Qwen: Qwen3 VL 8B Thinking

Description de la source (anglais)

Qwen3-VL-8B-Thinking is the reasoning-optimized variant of the Qwen3-VL-8B multimodal model, designed for advanced visual and textual reasoning across complex scenes, documents, and temporal sequences. It integrates enhanced multimodal alignment and...

Présentation

Caractéristiques du modèle

Contexte
131 072 tokens
Sortie maximale
32 768 tokens
Architecture
text+image->text
Tokenizer
Qwen3
Limite des connaissances
Non indiqué
Modéré
Non
OPENROUTER

Tarification complète

Tarifs synchronisés depuis OpenRouter, par million de tokens.

Entrée
$0.18
par million de tokens
Sortie
$2.1
par million de tokens
API

Configuration du modèle

Paramètres par défaut

temperature
1
top_p
0.95

Raisonnement

Raisonnement obligatoire
Oui
Paramètres par défaut
Non
API

Démarrage rapide

Définissez OPENROUTER_API_KEY localement. Python nécessite requests ; JavaScript s’exécute dans Node.js. Gardez la clé côté serveur.

Documentation de l’API

curl --fail-with-body https://openrouter.ai/api/v1/chat/completions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"qwen/qwen3-vl-8b-thinking","messages":[{"role":"user","content":"Hello!"}]}'
Capacités et modalités

EntréeSortie

Entrée
imagetext
Sortie
text
Raisonnement

Non

API

Paramètres API pris en charge

frequency_penaltyinclude_reasoninglogprobsmax_tokenspresence_penaltyreasoningresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p
Fournisseurs disponibles

1 Fournisseur

Vérifié: 7 septembre 2026

Fournisseurs en direct sur OpenRouter

Disponibilité, latence, débit et routage évoluent en continu. Consultez la source pour les données en temps réel.

OpenRouter

Alibaba

Non indiqué
Contexte
131K
Sortie maximale
33K
Entrée
$0.18
Sortie
$2.1
Lecture du cache
Non indiqué
Écriture du cache
Non indiqué
qwen

4 modèles

Tous les modèles
qwen logoqwen

Qwen: Qwen3.8 Omni Flash

Qwen3.8 Omni Flash is an omni-modal reasoning model from Alibaba, the first Qwen model built around agentic capabilities with native audio-video understanding. It is suited for audio-video analysis and summarization,...

Contexte
1M
Entrée
text · image · audio · video
Sortie
text
Entrée: $0.15Sortie: $0.47par million de tokens
Voir la fiche du modèle
qwen logoqwen

Qwen: Qwen3.8 Max (0902)

Qwen3.8 Max 0902 is an updated snapshot of Qwen3.8 Max from Alibaba's Qwen team. It is a 2.4-trillion-parameter mixture-of-experts model that accepts text, image, and video input and returns text,...

Contexte
1M
Entrée
text · image · video
Sortie
text
Entrée: $2Sortie: $6par million de tokens
Voir la fiche du modèle
qwen logoqwen

Qwen: Qwen3.8 Flash

Qwen3.8 Flash is a multimodal reasoning model from Alibaba. It is suited for coding assistance, agentic workflows, visual understanding, document and codebase analysis, desktop interaction, chart analysis, and long-video analysis.

Contexte
1M
Entrée
text · image · video
Sortie
text
Entrée: $0.15Sortie: $0.47par million de tokens
Voir la fiche du modèle
qwen logoqwen

Qwen: Qwen3.8 27B

Qwen3.8 27B is an open-weight dense vision-language model from Qwen. It is suited for coding, professional workflows, research, multimodal interaction, and long-running agent tasks, with flexible thinking that can be...

Contexte
1M
Entrée
text · image · video
Sortie
text
Entrée: $0.42Sortie: $3par million de tokens
Voir la fiche du modèle