Qwen3.7 Flash : prix, contexte et alternatives
Mise à jour le 25 septembre 2026Source : OpenRouterQwen
- Entrée
- 0,03 $par million de tokens
- Sortie
- 0,13 $par million de tokens
- Contexte
- 1 000 000tokens
- Sortie max
- 65 536tokens
- Disponible
- 27/07/2026via API
En bref
Qwen3.7 Flash est un modèle de raisonnement vision-langage édité par Qwen, disponible depuis le 27 juillet 2026. Il accepte 3 types d'entrées : image, texte et vidéo, pour produire du texte en sortie. Sa fenêtre de contexte atteint 1 000 000 tokens avec une limite de 65 536 tokens générés. Les prix publiés sont de 0,03 $ par million de tokens en entrée et 0,13 $ par million de tokens en sortie. Des options de cache existent à 0,006 $ pour la lecture et 0,038 $ pour l'écriture. Le modèle supporte l'appel d'outils et le raisonnement.
Repère de coût
0,125 $
pour 1 000 requêtes de 2 000 tokens en entrée et 500 en sortie avec Qwen3.7 Flash, d'après les prix publiés. Calcul LE LABO IA, hors cache et hors recherche web.
Concurrents directs
Le radar a sélectionné automatiquement des modèles comparables selon le type, la date de sortie et le rapport de prix.
| Modèle | Disponible | Entrée | Sortie | Contexte | 1 000 requêtes | Test vidéo |
|---|---|---|---|---|---|---|
| Qwen3.7 Flash | 27/07/2026 | 0,03 $ | 0,13 $ | 1 000 000 | 0,125 $ | Testé |
| Schematron V2 Turbo | 12/09/2026 | 0,03 $ | 0,15 $ | 128 000 | 0,135 $ | non |
| DeepSeek V4 Flash 0731 | 31/07/2026 | 0,03 $ | 0,32 $ | 1 310 720 | 0,22 $ | Testé |
| Mercury 2.5 | 08/09/2026 | 0,04 $ | 0,15 $ | 260 000 | 0,155 $ | non |
| Ling 3.0 Flash VL | 10/09/2026 | 0,021 $ | 0,0616 $ | 262 144 | 0,0728 $ | non |
| Ling 3.0 Flash | 23/07/2026 | 0,021 $ | 0,063 $ | 262 144 | 0,0735 $ | non |
Sélection automatique : même type de modèle, sorti à 90 jours près, prix d'entrée dans un rapport de 1 à 3. Prix en dollars par million de tokens, tels que publiés. La barre compare le coût de 1 000 requêtes au plus élevé du tableau.
Fiche complète
- Éditeur
- Qwen
- Famille
- Qwen
- Type
- Texte
- Identifiant API
qwen/qwen3.7-flash- Entrées
- image, texte, vidéo
- Sorties
- texte
- Entrée
- 0,03 $ par million de tokens
- Sortie
- 0,13 $ par million de tokens
- Lecture en cache
- 0,006 $ par million de tokens
- Écriture en cache
- 0,038 $ par million de tokens
- Contexte
- 1 000 000 tokens
- Sortie maximale
- 65 536 tokens
- Fonctions
- appel d'outils, raisonnement
- Dépôt Hugging Face
- aucun dépôt référencé
- Coupure des connaissances
- non communiquée
- Statut
- Remplacé : génération plus récente, Qwen3.8 Flash
Ce qu'on sait
- Modalités, date de disponibilité et identifiant d'API (OpenRouter)
- Prix publiés et leur unité (OpenRouter)
- Fenêtre de contexte (OpenRouter)
- Fonctions déclarées : appel d'outils, raisonnement
- Tests vidéo de Meydeey sur ce modèle
Ce qu'on ne sait pas encore
- Date de coupure des connaissances : non communiquée
- Nombre de paramètres : non publié par la source
- Scores de benchmark : le radar n'en affiche aucun sans source primaire
Pour aller plus loin
Générations de la gamme
- Qwen3.5-Flash25/02/2026
- Qwen3.6 Flash27/04/2026
- Qwen3.7 Flash27/07/2026
- Qwen3.8 Flash26/08/2026
Chronologie Qwen (texte)
- Qwen3.6 Flash27/04/2026
- Qwen3.6 Max Preview27/04/2026
- Qwen3.7 Max21/05/2026
- Qwen3.7 Plus03/06/2026
- Qwen3.7 Flash27/07/2026
- Qwen3.8 2.4T A95B12/08/2026
- Qwen3.8 27B14/08/2026
- Qwen3.8 Flash26/08/2026
- Qwen3.8 Max03/09/2026
Famille Qwen
Qwen3.7 Flash appartient à la gamme Qwen, avec une génération plus récente nommée Qwen3.8 Flash.
- Qwen3.8 Max Prime 4,00 $ / 12,00 $
- Qwen3.8 Omni Flash 0,15 $ / 0,47 $
- Qwen3.8 Max 2,00 $ / 6,00 $
- Qwen3.8 Flash 0,15 $ / 0,47 $
Comprendre
Utiliser
Suis chaque sortie dans le Radar IA
Crée ton compte gratuit sur LE SAS. Une fois ton démarrage terminé, tu accèdes au Radar IA, aux espaces ouverts de la communauté et à une sélection de cours gratuits.
Questions fréquentes
Combien coûte Qwen3.7 Flash ?
Le tarif est de 0,03 $ par million de tokens en entrée et 0,13 $ par million de tokens en sortie. La lecture en cache coûte 0,006 $ par million de tokens, tandis que l'écriture en cache s'élève à 0,038 $ par million de tokens.
Quelles sont les capacités multimodales de Qwen3.7 Flash ?
Qwen3.7 Flash traite 3 types d'entrées : l'image, le texte et la vidéo. Selon la description publiée, il s'agit d'un modèle de raisonnement vision-langage capable de générer du texte en réponse à ces différents formats.
Quelle est la taille de contexte de Qwen3.7 Flash ?
La fenêtre de contexte maximale est de 1 000 000 tokens. Le nombre maximum de tokens pouvant être générés en sortie est fixé à 65 536.
Existe-t-il une estimation du coût pour des requêtes standard sur Qwen3.7 Flash ?
LE LABO IA calcule un repère de 0,13 $ pour 1 000 requêtes, sur l'hypothèse de 2 000 tokens en entrée et 500 tokens en sortie par requête, basé sur les prix publiés.
