• Nouveau
  • Texte
  • Entrées texte

GLM 5.3 Prime : prix, contexte et alternatives

Mise à jour le 24 septembre 2026Source : OpenRouterZ.ai

Entrée
2,80 $par million de tokens
Sortie
8,80 $par million de tokens
Contexte
1 000 000tokens
Sortie max
131 072tokens
Disponible
23/09/2026via API

En bref

GLM 5.3 Prime est un modèle de texte édité par Z.ai, disponible depuis le 23 septembre 2026. Il accepte une entrée textuelle et produit une sortie textuelle, avec une fenêtre de contexte de 1 000 000 tokens et une limite de génération de 131 072 tokens. Selon la description publiée, il s'agit d'une variante haute vitesse héritant des capacités complètes du GLM-5.3, offrant un débit de sortie supérieur grâce à l'accélération de l'inférence. Le prix est de 2,8 $ par million de tokens en entrée, 8,8 $ par million de tokens en sortie et 0,56 $ par million de tokens pour la lecture en cache.

Repère de coût

1 000 requêtes de 2 000 tokens en entrée et 500 en sortie coûtent 10,00 $ avec GLM 5.3 Prime, d'après les prix publiés. Calcul LE LABO IA, hors cache et hors recherche web.

Concurrents directs

Le radar a sélectionné automatiquement des modèles comparables selon le type, la date de sortie et le rapport de prix.

ModèleDisponibleEntréeSortieContexte1 000 requêtesTest vidéo
GLM 5.3 Prime23/09/20262,80 $8,80 $1 000 00010,00 $non
Ember-124/09/20263,00 $15,00 $1 048 57613,50 $non
Aion 3.523/09/20263,00 $6,00 $262 1449,00 $non
Kimi K316/07/20263,00 $15,00 $1 048 57613,50 $oui
Aion-3.007/07/20263,00 $6,00 $131 0729,00 $non
Pareto17/09/20262,50 $7,50 $262 1448,75 $oui

Sélection automatique : même type de modèle, sorti à 90 jours près, prix d'entrée dans un rapport de 1 à 3. Prix en dollars par million de tokens, tels que publiés.

Fiche complète

Éditeur
Z.ai
Famille
GLM
Type
Texte
Identifiant API
z-ai/glm-5.3-prime
Entrées
texte
Sorties
texte
Entrée
2,80 $ par million de tokens
Sortie
8,80 $ par million de tokens
Lecture en cache
0,56 $ par million de tokens
Contexte
1 000 000 tokens
Sortie maximale
131 072 tokens
Fonctions
appel d'outils, raisonnement
Dépôt Hugging Face
aucun dépôt référencé
Coupure des connaissances
non communiquée
Statut
Nouveau

Ce qu'on sait

  • Modalités, date de disponibilité et identifiant d'API (OpenRouter)
  • Prix publiés et leur unité (OpenRouter)
  • Fenêtre de contexte (OpenRouter)
  • Fonctions déclarées : appel d'outils, raisonnement

Ce qu'on ne sait pas encore

  • Date de coupure des connaissances : non communiquée
  • Nombre de paramètres : non publié par la source
  • Scores de benchmark : le radar n'en affiche aucun sans source primaire

Suis chaque sortie dans le Radar IA

Crée ton compte gratuit sur LE SAS. Une fois ton démarrage terminé, tu accèdes au Radar IA, aux espaces ouverts de la communauté et à une sélection de cours gratuits.

Créer mon compte gratuit

Questions fréquentes

Quelles sont les fonctionnalités clés de GLM 5.3 Prime ?

GLM 5.3 Prime prend en charge l'appel d'outils et le raisonnement. Ces 2 capacités sont explicitement listées dans les caractéristiques du modèle.

Combien coûte GLM 5.3 Prime ?

Le tarif publié est de 2,8 $ par million de tokens en entrée et 8,8 $ par million de tokens en sortie. La lecture en cache coûte 0,56 $ par million de tokens. Un repère calculé par LE LABO IA estime le coût à 10 $ pour 1 000 requêtes de 2 000 tokens en entrée et 500 en sortie.

Quelle est la taille de la fenêtre de contexte de GLM 5.3 Prime ?

La fenêtre de contexte de GLM 5.3 Prime est de 1 000 000 tokens. La longueur maximale de la sortie générée est fixée à 131 072 tokens.

GLM 5.3 Prime est-il payant sur OpenRouter ?

Oui, GLM 5.3 Prime est payant sur OpenRouter au relevé du 24 septembre 2026. Des prix spécifiques sont publiés pour l'entrée, la sortie et la lecture en cache.

Données : catalogue public d'OpenRouter, relevé chaque jour. Dernière évolution de cette fiche le 24 septembre 2026.

Résumé et questions : rédigés le 24 septembre 2026 par un agent IA (Qwen3.8 Flash) à partir de ces seules données, puis contrôlés automatiquement : chaque nombre doit exister dans la source.

Radar tenu par Meydeey, architecte ia et automatisation. Méthode éditoriale.