Qwen3 VL 8B Thinking : prix, contexte et alternatives
Mise à jour le 25 septembre 2026Source : OpenRouterQwen
- Entrée
- 0,18 $par million de tokens
- Sortie
- 2,10 $par million de tokens
- Contexte
- 131 072tokens
- Sortie max
- 32 768tokens
- Disponible
- 14/10/2025via API
En bref
Qwen3 VL 8B Thinking est un modèle multimodal édité par Qwen, disponible depuis le 14 octobre 2025. Il accepte 2 types d'entrées (image et texte) et produit du texte en sortie. Selon la description publiée, il s'agit de la variante optimisée pour le raisonnement du modèle Qwen3-VL-8B, conçue pour le raisonnement visuel et textuel avancé sur des scènes complexes, des documents et des séquences temporelles. Le prix est de 0,18 $ par million de tokens en entrée et 2,1 $ par million de tokens en sortie. La fin annoncée est fixée au 9 octobre 2026.
Repère de coût
1,41 $
pour 1 000 requêtes de 2 000 tokens en entrée et 500 en sortie avec Qwen3 VL 8B Thinking, d'après les prix publiés. Calcul LE LABO IA, hors cache et hors recherche web.
Concurrents directs
Le radar a sélectionné automatiquement des modèles comparables selon ses critères internes.
| Modèle | Disponible | Entrée | Sortie | Contexte | 1 000 requêtes | Test vidéo |
|---|---|---|---|---|---|---|
| Qwen3 VL 8B Thinking | 14/10/2025 | 0,18 $ | 2,10 $ | 131 072 | 1,41 $ | non |
| Qwen3 Coder Flash | 17/09/2025 | 0,195 $ | 0,975 $ | 1 000 000 | 0,8775 $ | non |
| Ministral 3 14B 2512 | 02/12/2025 | 0,20 $ | 0,20 $ | 262 144 | 0,50 $ | non |
| Qwen3 VL 30B A3B Thinking | 06/10/2025 | 0,20 $ | 2,40 $ | 262 144 | 1,60 $ | non |
| Qwen3 30B A3B Thinking 2507 | 28/08/2025 | 0,20 $ | 2,40 $ | 81 920 | 1,60 $ | non |
| Qwen3 VL 235B A22B Instruct | 23/09/2025 | 0,21 $ | 1,90 $ | 262 144 | 1,37 $ | non |
Sélection automatique : même type de modèle, sorti à 90 jours près, prix d'entrée dans un rapport de 1 à 3. Prix en dollars par million de tokens, tels que publiés. La barre compare le coût de 1 000 requêtes au plus élevé du tableau.
Fiche complète
- Éditeur
- Qwen
- Famille
- Qwen
- Type
- Texte
- Identifiant API
qwen/qwen3-vl-8b-thinking- Entrées
- image, texte
- Sorties
- texte
- Entrée
- 0,18 $ par million de tokens
- Sortie
- 2,10 $ par million de tokens
- Contexte
- 131 072 tokens
- Sortie maximale
- 32 768 tokens
- Fonctions
- appel d'outils, raisonnement, sorties structurées
- Dépôt Hugging Face
- Qwen/Qwen3-VL-8B-Thinking
- Coupure des connaissances
- non communiquée
- Fin annoncée
- 9 octobre 2026
- Statut
- Fin annoncée
Ce qu'on sait
- Modalités, date de disponibilité et identifiant d'API (OpenRouter)
- Prix publiés et leur unité (OpenRouter)
- Fenêtre de contexte (OpenRouter)
- Fonctions déclarées : appel d'outils, raisonnement, sorties structurées
Ce qu'on ne sait pas encore
- Date de coupure des connaissances : non communiquée
- Scores de benchmark : le radar n'en affiche aucun sans source primaire
Pour aller plus loin
Chronologie Qwen (texte)
- Qwen3 VL 235B A22B Thinking23/09/2025
- Qwen3 VL 30B A3B Instruct06/10/2025
- Qwen3 VL 30B A3B Thinking06/10/2025
- Qwen3 VL 8B Instruct14/10/2025
- Qwen3 VL 8B Thinking14/10/2025
- Qwen3 VL 32B Instruct23/10/2025
- Qwen3 Coder Next04/02/2026
- Qwen3 Max Thinking09/02/2026
- Qwen3.5 397B A17B16/02/2026
Famille Qwen
Qwen3 VL 8B Thinking appartient à la gamme Qwen, développée par l'éditeur Qwen.
- Qwen3.8 Max Prime 4,00 $ / 12,00 $
- Qwen3.8 Omni Flash 0,15 $ / 0,47 $
- Qwen3.8 Max 2,00 $ / 6,00 $
- Qwen3.8 Flash 0,15 $ / 0,47 $
Comprendre
Utiliser
Suis chaque sortie dans le Radar IA
Crée ton compte gratuit sur LE SAS. Une fois ton démarrage terminé, tu accèdes au Radar IA, aux espaces ouverts de la communauté et à une sélection de cours gratuits.
Questions fréquentes
Combien coûte Qwen3 VL 8B Thinking ?
Le tarif publié est de 0,18 $ par million de tokens en entrée et 2,1 $ par million de tokens en sortie. Un repère calculé par LE LABO IA estime le coût à 1,41 $ pour 1 000 requêtes, avec l'hypothèse de 2 000 tokens en entrée et 500 en sortie par requête.
Quelles sont les capacités spécifiques de Qwen3 VL 8B Thinking ?
Qwen3 VL 8B Thinking prend en charge l'appel d'outils, le raisonnement et les sorties structurées. Il dispose d'une fenêtre de contexte de 131 072 tokens et peut générer jusqu'à 32 768 tokens en sortie.
Jusqu'à quand Qwen3 VL 8B Thinking sera-t-il disponible ?
La source indique une date de fin annoncée pour Qwen3 VL 8B Thinking au 9 octobre 2026. Aucune information n'est communiquée concernant une éventuelle génération plus récente ou des variantes associées à ce jour.