• Remplacé
  • Testé en vidéo
  • Texte
  • Entrées image, texte, vidéo

Qwen3.7 Flash : prix, contexte et alternatives

Mise à jour le 25 septembre 2026Source : OpenRouterQwen

Entrée
0,03 $par million de tokens
Sortie
0,13 $par million de tokens
Contexte
1 000 000tokens
Sortie max
65 536tokens
Disponible
27/07/2026via API

En bref

Qwen3.7 Flash est un modèle de raisonnement vision-langage édité par Qwen, disponible depuis le 27 juillet 2026. Il accepte 3 types d'entrées : image, texte et vidéo, pour produire du texte en sortie. Sa fenêtre de contexte atteint 1 000 000 tokens avec une limite de 65 536 tokens générés. Les prix publiés sont de 0,03 $ par million de tokens en entrée et 0,13 $ par million de tokens en sortie. Des options de cache existent à 0,006 $ pour la lecture et 0,038 $ pour l'écriture. Le modèle supporte l'appel d'outils et le raisonnement.

Repère de coût

0,125 $

pour 1 000 requêtes de 2 000 tokens en entrée et 500 en sortie avec Qwen3.7 Flash, d'après les prix publiés. Calcul LE LABO IA, hors cache et hors recherche web.

Concurrents directs

Le radar a sélectionné automatiquement des modèles comparables selon le type, la date de sortie et le rapport de prix.

ModèleDisponibleEntréeSortieContexte1 000 requêtesTest vidéo
Qwen3.7 Flash27/07/20260,03 $0,13 $1 000 0000,125 $Testé
Schematron V2 Turbo12/09/20260,03 $0,15 $128 0000,135 $non
DeepSeek V4 Flash 073131/07/20260,03 $0,32 $1 310 7200,22 $Testé
Mercury 2.508/09/20260,04 $0,15 $260 0000,155 $non
Ling 3.0 Flash VL10/09/20260,021 $0,0616 $262 1440,0728 $non
Ling 3.0 Flash23/07/20260,021 $0,063 $262 1440,0735 $non

Sélection automatique : même type de modèle, sorti à 90 jours près, prix d'entrée dans un rapport de 1 à 3. Prix en dollars par million de tokens, tels que publiés. La barre compare le coût de 1 000 requêtes au plus élevé du tableau.

Fiche complète

Éditeur
Qwen
Famille
Qwen
Type
Texte
Identifiant API
qwen/qwen3.7-flash
Entrées
image, texte, vidéo
Sorties
texte
Entrée
0,03 $ par million de tokens
Sortie
0,13 $ par million de tokens
Lecture en cache
0,006 $ par million de tokens
Écriture en cache
0,038 $ par million de tokens
Contexte
1 000 000 tokens
Sortie maximale
65 536 tokens
Fonctions
appel d'outils, raisonnement
Dépôt Hugging Face
aucun dépôt référencé
Coupure des connaissances
non communiquée
Statut
Remplacé : génération plus récente, Qwen3.8 Flash

Ce qu'on sait

  • Modalités, date de disponibilité et identifiant d'API (OpenRouter)
  • Prix publiés et leur unité (OpenRouter)
  • Fenêtre de contexte (OpenRouter)
  • Fonctions déclarées : appel d'outils, raisonnement
  • Tests vidéo de Meydeey sur ce modèle

Ce qu'on ne sait pas encore

  • Date de coupure des connaissances : non communiquée
  • Nombre de paramètres : non publié par la source
  • Scores de benchmark : le radar n'en affiche aucun sans source primaire

Pour aller plus loin

Générations de la gamme

  1. Qwen3.5-Flash25/02/2026
  2. Qwen3.6 Flash27/04/2026
  3. Qwen3.7 Flash27/07/2026
  4. Qwen3.8 Flash26/08/2026

Chronologie Qwen (texte)

  1. Qwen3.6 Flash27/04/2026
  2. Qwen3.6 Max Preview27/04/2026
  3. Qwen3.7 Max21/05/2026
  4. Qwen3.7 Plus03/06/2026
  5. Qwen3.7 Flash27/07/2026
  6. Qwen3.8 2.4T A95B12/08/2026
  7. Qwen3.8 27B14/08/2026
  8. Qwen3.8 Flash26/08/2026
  9. Qwen3.8 Max03/09/2026
Les 50 sorties de la famille

Famille Qwen

Qwen3.7 Flash appartient à la gamme Qwen, avec une génération plus récente nommée Qwen3.8 Flash.

Tous les modèles Qwen (60)

Comprendre

Utiliser

Suis chaque sortie dans le Radar IA

Crée ton compte gratuit sur LE SAS. Une fois ton démarrage terminé, tu accèdes au Radar IA, aux espaces ouverts de la communauté et à une sélection de cours gratuits.

Créer mon compte gratuit

Questions fréquentes

Combien coûte Qwen3.7 Flash ?

Le tarif est de 0,03 $ par million de tokens en entrée et 0,13 $ par million de tokens en sortie. La lecture en cache coûte 0,006 $ par million de tokens, tandis que l'écriture en cache s'élève à 0,038 $ par million de tokens.

Quelles sont les capacités multimodales de Qwen3.7 Flash ?

Qwen3.7 Flash traite 3 types d'entrées : l'image, le texte et la vidéo. Selon la description publiée, il s'agit d'un modèle de raisonnement vision-langage capable de générer du texte en réponse à ces différents formats.

Quelle est la taille de contexte de Qwen3.7 Flash ?

La fenêtre de contexte maximale est de 1 000 000 tokens. Le nombre maximum de tokens pouvant être générés en sortie est fixé à 65 536.

Existe-t-il une estimation du coût pour des requêtes standard sur Qwen3.7 Flash ?

LE LABO IA calcule un repère de 0,13 $ pour 1 000 requêtes, sur l'hypothèse de 2 000 tokens en entrée et 500 tokens en sortie par requête, basé sur les prix publiés.