• Nouveau
  • Texte
  • Entrées audio, image, texte, vidéo

Qwen3.8 Omni Flash : prix, contexte et alternatives

Mise à jour le 25 septembre 2026Source : OpenRouterQwen

Entrée
0,15 $par million de tokens
Sortie
0,47 $par million de tokens
Contexte
1 000 000tokens
Sortie max
131 072tokens
Disponible
21/09/2026via API

En bref

Qwen3.8 Omni Flash est un modèle d'intelligence artificielle édité par Qwen, disponible depuis le 21 septembre 2026. Il s'agit d'un modèle omni-modal capable de traiter 4 types d'entrées : audio, image, texte et vidéo, pour produire du texte en sortie. Selon la description publiée, c'est le premier modèle Qwen conçu autour des capacités agentiques avec une compréhension native de l'audio-vidéo. Le contexte atteint 1 000 000 tokens. Les prix sont fixés à 0,15 $ par million de tokens en entrée et 0,47 $ par million de tokens en sortie.

Repère de coût

1 000 requêtes de 2 000 tokens en entrée et 500 en sortie coûtent 0,535 $ avec Qwen3.8 Omni Flash, d'après les prix publiés. Calcul LE LABO IA, hors cache et hors recherche web.

Concurrents directs

Le radar a identifié automatiquement des modèles concurrents basés sur des critères de type, de date de sortie et de prix.

ModèleDisponibleEntréeSortieContexte1 000 requêtesTest vidéo
Qwen3.8 Omni Flash21/09/20260,15 $0,47 $1 000 0000,535 $non
DeepSeek V4.1 Flash10/09/20260,15 $0,60 $1 048 5760,60 $oui
Qwen3.8 Flash26/08/20260,15 $0,47 $1 000 0000,535 $oui
MiMo-V2.6-Flash21/09/20260,14 $0,28 $1 048 5760,42 $non
Hy306/07/20260,132 $0,528 $262 1440,528 $non
GPT-5.6 Luna09/07/20260,20 $1,20 $1 050 0001,00 $non

Sélection automatique : même type de modèle, sorti à 90 jours près, prix d'entrée dans un rapport de 1 à 3. Prix en dollars par million de tokens, tels que publiés.

Fiche complète

Éditeur
Qwen
Famille
Qwen
Type
Texte
Identifiant API
qwen/qwen3.8-omni-flash
Entrées
audio, image, texte, vidéo
Sorties
texte
Entrée
0,15 $ par million de tokens
Sortie
0,47 $ par million de tokens
Lecture en cache
0,016 $ par million de tokens
Contexte
1 000 000 tokens
Sortie maximale
131 072 tokens
Fonctions
appel d'outils, raisonnement, sorties structurées
Dépôt Hugging Face
aucun dépôt référencé
Coupure des connaissances
non communiquée
Statut
Nouveau

Ce qu'on sait

  • Modalités, date de disponibilité et identifiant d'API (OpenRouter)
  • Prix publiés et leur unité (OpenRouter)
  • Fenêtre de contexte (OpenRouter)
  • Fonctions déclarées : appel d'outils, raisonnement, sorties structurées

Ce qu'on ne sait pas encore

  • Date de coupure des connaissances : non communiquée
  • Nombre de paramètres : non publié par la source
  • Scores de benchmark : le radar n'en affiche aucun sans source primaire

Suis chaque sortie dans le Radar IA

Crée ton compte gratuit sur LE SAS. Une fois ton démarrage terminé, tu accèdes au Radar IA, aux espaces ouverts de la communauté et à une sélection de cours gratuits.

Créer mon compte gratuit

Questions fréquentes

Quelles sont les fonctionnalités clés de Qwen3.8 Omni Flash ?

Qwen3.8 Omni Flash prend en charge l'appel d'outils, le raisonnement et les sorties structurées. Ces fonctionnalités permettent au modèle d'interagir avec des outils externes, de mener des processus logiques complexes et de générer des réponses dans des formats prédéfinis.

Combien coûte Qwen3.8 Omni Flash ?

Le prix d'entrée est de 0,15 $ par million de tokens. Le prix de sortie est de 0,47 $ par million de tokens. Une lecture en cache coûte 0,016 $ par million de tokens. Pour 1 000 requêtes standard (2 000 tokens en entrée, 500 en sortie), le coût estimé est de 0,54 $.

Quelle est la taille du contexte de Qwen3.8 Omni Flash ?

La fenêtre de contexte de Qwen3.8 Omni Flash est de 1 000 000 tokens. La longueur maximale de sortie est de 131 072 tokens. Ces limites définissent la quantité d'informations que le modèle peut traiter simultanément et générer en une seule réponse.

Données : catalogue public d'OpenRouter, relevé chaque jour. Dernière évolution de cette fiche le 25 septembre 2026.

Résumé et questions : rédigés le 24 septembre 2026 par un agent IA (Qwen3.8 Flash) à partir de ces seules données, puis contrôlés automatiquement : chaque nombre doit exister dans la source.

Radar tenu par Meydeey, architecte ia et automatisation. Méthode éditoriale.