Qwen3.5-Flash : prix, contexte et alternatives
Mise à jour le 25 septembre 2026Source : OpenRouterQwen
- Entrée
- 0,065 $par million de tokens
- Sortie
- 0,26 $par million de tokens
- Contexte
- 1 000 000tokens
- Sortie max
- 65 536tokens
- Disponible
- 25/02/2026via API
En bref
Qwen3.5-Flash est un modèle d'intelligence artificielle édité par Qwen, disponible depuis le 25 février 2026. Il traite 3 types d'entrées : image, texte et vidéo, pour produire du texte. Selon la description publiée, il repose sur une architecture hybride intégrant une attention linéaire et un mélange sparse d'experts. Le prix est de 0,065 $ par million de tokens en entrée et 0,26 $ par million de tokens en sortie. Il offre un contexte de 1 000 000 de tokens et une sortie maximale de 65 536 tokens.
Repère de coût
0,26 $
pour 1 000 requêtes de 2 000 tokens en entrée et 500 en sortie avec Qwen3.5-Flash, d'après les prix publiés. Calcul LE LABO IA, hors cache et hors recherche web.
Concurrents directs
Le radar a sélectionné automatiquement des modèles concurrents selon des critères de type, de date et de prix.
| Modèle | Disponible | Entrée | Sortie | Contexte | 1 000 requêtes | Test vidéo |
|---|---|---|---|---|---|---|
| Qwen3.5-Flash | 25/02/2026 | 0,065 $ | 0,26 $ | 1 000 000 | 0,26 $ | non |
| Gemma 4 26B A4B | 03/04/2026 | 0,0675 $ | 0,225 $ | 262 144 | 0,2475 $ | non |
| GLM 4.7 Flash | 19/01/2026 | 0,0605 $ | 0,40 $ | 200 000 | 0,321 $ | non |
| Seed 1.6 Flash | 23/12/2025 | 0,075 $ | 0,30 $ | 262 144 | 0,30 $ | non |
| Nemotron 3 Super | 11/03/2026 | 0,08 $ | 0,45 $ | 262 144 | 0,385 $ | non |
| Nemotron 3 Nano 30B A3B | 14/12/2025 | 0,05 $ | 0,20 $ | 262 144 | 0,20 $ | non |
Sélection automatique : même type de modèle, sorti à 90 jours près, prix d'entrée dans un rapport de 1 à 3. Prix en dollars par million de tokens, tels que publiés. La barre compare le coût de 1 000 requêtes au plus élevé du tableau.
Fiche complète
- Éditeur
- Qwen
- Famille
- Qwen
- Type
- Texte
- Identifiant API
qwen/qwen3.5-flash-02-23- Entrées
- image, texte, vidéo
- Sorties
- texte
- Entrée
- 0,065 $ par million de tokens
- Sortie
- 0,26 $ par million de tokens
- Contexte
- 1 000 000 tokens
- Sortie maximale
- 65 536 tokens
- Fonctions
- appel d'outils, raisonnement, sorties structurées
- Dépôt Hugging Face
- aucun dépôt référencé
- Coupure des connaissances
- non communiquée
- Statut
- Remplacé : génération plus récente, Qwen3.8 Flash
Ce qu'on sait
- Modalités, date de disponibilité et identifiant d'API (OpenRouter)
- Prix publiés et leur unité (OpenRouter)
- Fenêtre de contexte (OpenRouter)
- Fonctions déclarées : appel d'outils, raisonnement, sorties structurées
Ce qu'on ne sait pas encore
- Date de coupure des connaissances : non communiquée
- Nombre de paramètres : non publié par la source
- Scores de benchmark : le radar n'en affiche aucun sans source primaire
Pour aller plus loin
Générations de la gamme
- Qwen3.5-Flash25/02/2026
- Qwen3.6 Flash27/04/2026
- Qwen3.7 Flash27/07/2026
- Qwen3.8 Flash26/08/2026
Chronologie Qwen (texte)
- Qwen3.5 397B A17B16/02/2026
- Qwen3.5-122B-A10B25/02/2026
- Qwen3.5-27B25/02/2026
- Qwen3.5-35B-A3B25/02/2026
- Qwen3.5-Flash25/02/2026
- Qwen3.5-9B10/03/2026
- Qwen3.6 Plus02/04/2026
- Qwen3.5 Plus27/04/2026
- Qwen3.6 27B27/04/2026
Famille Qwen
Qwen3.5-Flash fait partie de la famille Qwen, développée par l'éditeur Qwen.
- Qwen3.8 Max Prime 4,00 $ / 12,00 $
- Qwen3.8 Omni Flash 0,15 $ / 0,47 $
- Qwen3.8 Max 2,00 $ / 6,00 $
- Qwen3.8 Flash 0,15 $ / 0,47 $
Comprendre
Utiliser
Suis chaque sortie dans le Radar IA
Crée ton compte gratuit sur LE SAS. Une fois ton démarrage terminé, tu accèdes au Radar IA, aux espaces ouverts de la communauté et à une sélection de cours gratuits.
Questions fréquentes
Quelles sont les capacités fonctionnelles de Qwen3.5-Flash ?
Qwen3.5-Flash prend en charge l'appel d'outils, le raisonnement et les sorties structurées. Ces fonctionnalités permettent au modèle d'interagir avec des systèmes externes, de suivre des chaînes logiques complexes et de générer des données formatées selon des schémas précis.
Combien coûte Qwen3.5-Flash pour 1 000 requêtes ?
Le coût estimé pour 1 000 requêtes est de 0,26 $. Cette estimation se base sur une hypothèse de 2 000 tokens en entrée et 500 tokens en sortie par requête, calculée par LE LABO IA à partir des prix publiés par la source.
Quelle est la taille de la fenêtre de contexte de Qwen3.5-Flash ?
La fenêtre de contexte de Qwen3.5-Flash est de 1 000 000 de tokens. La longueur maximale de la sortie générée par le modèle est fixée à 65 536 tokens.
Existe-t-il une génération plus récente que Qwen3.5-Flash ?
Oui, une génération plus récente existe dans la même gamme chez le même éditeur : Qwen3.8 Flash. Le statut de retrait de Qwen3.5-Flash est non communiqué.