GLM 4.7 Flash : prix, contexte et alternatives
Mise à jour le 25 septembre 2026Source : OpenRouterZ.ai
- Entrée
- 0,0605 $par million de tokens
- Sortie
- 0,40 $par million de tokens
- Contexte
- 200 000tokens
- Sortie max
- 117 964tokens
- Disponible
- 19/01/2026via API
En bref
GLM 4.7 Flash est un modèle de texte édité par Z.ai, disponible depuis le 19 janvier 2026. Il accepte une entrée de type texte et produit une sortie de type texte, avec une fenêtre de contexte de 200 000 tokens et une limite de génération de 117 964 tokens. Selon la description publiée, il s'agit d'un modèle de classe 30B offrant un équilibre entre performance et efficacité. Le prix est fixé à 0,0605 $ par million de tokens en entrée et 0,4 $ par million de tokens en sortie. Une génération plus récente, GLM 5.3 Flash, existe.
Repère de coût
0,321 $
pour 1 000 requêtes de 2 000 tokens en entrée et 500 en sortie avec GLM 4.7 Flash, d'après les prix publiés. Calcul LE LABO IA, hors cache et hors recherche web.
Concurrents directs
Le radar a identifié automatiquement des modèles concurrents selon ses critères de sélection.
| Modèle | Disponible | Entrée | Sortie | Contexte | 1 000 requêtes | Test vidéo |
|---|---|---|---|---|---|---|
| GLM 4.7 Flash | 19/01/2026 | 0,0605 $ | 0,40 $ | 200 000 | 0,321 $ | non |
| Qwen3.5-Flash | 25/02/2026 | 0,065 $ | 0,26 $ | 1 000 000 | 0,26 $ | non |
| Gemma 4 26B A4B | 03/04/2026 | 0,0675 $ | 0,225 $ | 262 144 | 0,2475 $ | non |
| Nemotron 3 Nano 30B A3B | 14/12/2025 | 0,05 $ | 0,20 $ | 262 144 | 0,20 $ | non |
| Seed 1.6 Flash | 23/12/2025 | 0,075 $ | 0,30 $ | 262 144 | 0,30 $ | non |
| gpt-oss-safeguard-20b | 29/10/2025 | 0,075 $ | 0,30 $ | 131 072 | 0,30 $ | non |
Sélection automatique : même type de modèle, sorti à 90 jours près, prix d'entrée dans un rapport de 1 à 3. Prix en dollars par million de tokens, tels que publiés. La barre compare le coût de 1 000 requêtes au plus élevé du tableau.
Fiche complète
- Éditeur
- Z.ai
- Famille
- GLM
- Type
- Texte
- Identifiant API
z-ai/glm-4.7-flash- Entrées
- texte
- Sorties
- texte
- Entrée
- 0,0605 $ par million de tokens
- Sortie
- 0,40 $ par million de tokens
- Contexte
- 200 000 tokens
- Sortie maximale
- 117 964 tokens
- Fonctions
- appel d'outils, raisonnement, sorties structurées
- Dépôt Hugging Face
- zai-org/GLM-4.7-Flash
- Coupure des connaissances
- non communiquée
- Statut
- Remplacé : génération plus récente, GLM 5.3 Flash
Ce qu'on sait
- Modalités, date de disponibilité et identifiant d'API (OpenRouter)
- Prix publiés et leur unité (OpenRouter)
- Fenêtre de contexte (OpenRouter)
- Fonctions déclarées : appel d'outils, raisonnement, sorties structurées
Ce qu'on ne sait pas encore
- Date de coupure des connaissances : non communiquée
- Nombre de paramètres : non publié par la source
- Scores de benchmark : le radar n'en affiche aucun sans source primaire
Pour aller plus loin
Générations de la gamme
- GLM 4.7 Flash19/01/2026
- GLM 5.3 Flash26/08/2026
Chronologie GLM (texte)
- GLM 4.5V11/08/2025
- GLM 4.630/09/2025
- GLM 4.6V08/12/2025
- GLM 4.722/12/2025
- GLM 4.7 Flash19/01/2026
- GLM 511/02/2026
- GLM 5 Turbo15/03/2026
- GLM 5V Turbo01/04/2026
- GLM 5.107/04/2026
Famille GLM
GLM 4.7 Flash appartient à la gamme GLM développée par Z.ai.
- GLM 5.3 Prime 2,80 $ / 8,80 $
- GLM 5.3 FlashX 0,37 $ / 1,25 $
- GLM 5.3 Flash 0,045 $ / 0,14 $
- GLM 5.3 1,40 $ / 4,40 $
Comprendre
Utiliser
Suis chaque sortie dans le Radar IA
Crée ton compte gratuit sur LE SAS. Une fois ton démarrage terminé, tu accèdes au Radar IA, aux espaces ouverts de la communauté et à une sélection de cours gratuits.
Questions fréquentes
Combien coûte GLM 4.7 Flash ?
Le tarif publié par la source est de 0,0605 $ par million de tokens pour l'entrée et de 0,4 $ par million de tokens pour la sortie. Ces prix sont exprimés en dollars américains.
Quelles sont les capacités fonctionnelles de GLM 4.7 Flash ?
GLM 4.7 Flash prend en charge l'appel d'outils, le raisonnement et la production de sorties structurées. Ces fonctionnalités sont listées dans les caractéristiques du modèle.
Quelle est la taille de contexte de GLM 4.7 Flash ?
La fenêtre de contexte de GLM 4.7 Flash est de 200 000 tokens. La longueur maximale de sortie générée par le modèle est de 117 964 tokens.
Existe-t-il un dépôt Hugging Face pour GLM 4.7 Flash ?
Oui, un dépôt Hugging Face est référencé par la source sous l'identifiant zai-org/GLM-4.7-Flash. Les informations sur la licence ou les poids ne sont pas communiquées au-delà de cette référence.