• Remplacé
  • Texte
  • Entrées image, texte, vidéo

Qwen3.5-Flash : prix, contexte et alternatives

Mise à jour le 25 septembre 2026Source : OpenRouterQwen

Entrée
0,065 $par million de tokens
Sortie
0,26 $par million de tokens
Contexte
1 000 000tokens
Sortie max
65 536tokens
Disponible
25/02/2026via API

En bref

Qwen3.5-Flash est un modèle d'intelligence artificielle édité par Qwen, disponible depuis le 25 février 2026. Il traite 3 types d'entrées : image, texte et vidéo, pour produire du texte. Selon la description publiée, il repose sur une architecture hybride intégrant une attention linéaire et un mélange sparse d'experts. Le prix est de 0,065 $ par million de tokens en entrée et 0,26 $ par million de tokens en sortie. Il offre un contexte de 1 000 000 de tokens et une sortie maximale de 65 536 tokens.

Repère de coût

0,26 $

pour 1 000 requêtes de 2 000 tokens en entrée et 500 en sortie avec Qwen3.5-Flash, d'après les prix publiés. Calcul LE LABO IA, hors cache et hors recherche web.

Concurrents directs

Le radar a sélectionné automatiquement des modèles concurrents selon des critères de type, de date et de prix.

ModèleDisponibleEntréeSortieContexte1 000 requêtesTest vidéo
Qwen3.5-Flash25/02/20260,065 $0,26 $1 000 0000,26 $non
Gemma 4 26B A4B03/04/20260,0675 $0,225 $262 1440,2475 $non
GLM 4.7 Flash19/01/20260,0605 $0,40 $200 0000,321 $non
Seed 1.6 Flash23/12/20250,075 $0,30 $262 1440,30 $non
Nemotron 3 Super11/03/20260,08 $0,45 $262 1440,385 $non
Nemotron 3 Nano 30B A3B14/12/20250,05 $0,20 $262 1440,20 $non

Sélection automatique : même type de modèle, sorti à 90 jours près, prix d'entrée dans un rapport de 1 à 3. Prix en dollars par million de tokens, tels que publiés. La barre compare le coût de 1 000 requêtes au plus élevé du tableau.

Fiche complète

Éditeur
Qwen
Famille
Qwen
Type
Texte
Identifiant API
qwen/qwen3.5-flash-02-23
Entrées
image, texte, vidéo
Sorties
texte
Entrée
0,065 $ par million de tokens
Sortie
0,26 $ par million de tokens
Contexte
1 000 000 tokens
Sortie maximale
65 536 tokens
Fonctions
appel d'outils, raisonnement, sorties structurées
Dépôt Hugging Face
aucun dépôt référencé
Coupure des connaissances
non communiquée
Statut
Remplacé : génération plus récente, Qwen3.8 Flash

Ce qu'on sait

  • Modalités, date de disponibilité et identifiant d'API (OpenRouter)
  • Prix publiés et leur unité (OpenRouter)
  • Fenêtre de contexte (OpenRouter)
  • Fonctions déclarées : appel d'outils, raisonnement, sorties structurées

Ce qu'on ne sait pas encore

  • Date de coupure des connaissances : non communiquée
  • Nombre de paramètres : non publié par la source
  • Scores de benchmark : le radar n'en affiche aucun sans source primaire

Pour aller plus loin

Générations de la gamme

  1. Qwen3.5-Flash25/02/2026
  2. Qwen3.6 Flash27/04/2026
  3. Qwen3.7 Flash27/07/2026
  4. Qwen3.8 Flash26/08/2026

Chronologie Qwen (texte)

  1. Qwen3.5 397B A17B16/02/2026
  2. Qwen3.5-122B-A10B25/02/2026
  3. Qwen3.5-27B25/02/2026
  4. Qwen3.5-35B-A3B25/02/2026
  5. Qwen3.5-Flash25/02/2026
  6. Qwen3.5-9B10/03/2026
  7. Qwen3.6 Plus02/04/2026
  8. Qwen3.5 Plus27/04/2026
  9. Qwen3.6 27B27/04/2026
Les 50 sorties de la famille

Famille Qwen

Qwen3.5-Flash fait partie de la famille Qwen, développée par l'éditeur Qwen.

Tous les modèles Qwen (60)

Comprendre

Utiliser

Suis chaque sortie dans le Radar IA

Crée ton compte gratuit sur LE SAS. Une fois ton démarrage terminé, tu accèdes au Radar IA, aux espaces ouverts de la communauté et à une sélection de cours gratuits.

Créer mon compte gratuit

Questions fréquentes

Quelles sont les capacités fonctionnelles de Qwen3.5-Flash ?

Qwen3.5-Flash prend en charge l'appel d'outils, le raisonnement et les sorties structurées. Ces fonctionnalités permettent au modèle d'interagir avec des systèmes externes, de suivre des chaînes logiques complexes et de générer des données formatées selon des schémas précis.

Combien coûte Qwen3.5-Flash pour 1 000 requêtes ?

Le coût estimé pour 1 000 requêtes est de 0,26 $. Cette estimation se base sur une hypothèse de 2 000 tokens en entrée et 500 tokens en sortie par requête, calculée par LE LABO IA à partir des prix publiés par la source.

Quelle est la taille de la fenêtre de contexte de Qwen3.5-Flash ?

La fenêtre de contexte de Qwen3.5-Flash est de 1 000 000 de tokens. La longueur maximale de la sortie générée par le modèle est fixée à 65 536 tokens.

Existe-t-il une génération plus récente que Qwen3.5-Flash ?

Oui, une génération plus récente existe dans la même gamme chez le même éditeur : Qwen3.8 Flash. Le statut de retrait de Qwen3.5-Flash est non communiqué.