• Actif
  • Texte
  • Entrées texte

Kimi K2 Thinking : prix, contexte et alternatives

Mise à jour le 25 septembre 2026Source : OpenRouterMoonshotAI

Entrée
0,60 $par million de tokens
Sortie
2,50 $par million de tokens
Contexte
262 144tokens
Sortie max
98 304tokens
Disponible
06/11/2025via API

En bref

Kimi K2 Thinking est un modèle d'intelligence artificielle édité par MoonshotAI, disponible depuis le 6 novembre 2025. Il traite des entrées de texte et produit des sorties textuelles, avec une fenêtre de contexte de 262 144 tokens et une limite de sortie de 98 304 tokens. Ses fonctionnalités incluent l'appel d'outils, le raisonnement et les sorties structurées. Le prix est de 0,6 $ par million de tokens en entrée, 2,5 $ par million de tokens en sortie et 0,15 $ par million de tokens pour la lecture en cache.

Repère de coût

2,45 $

pour 1 000 requêtes de 2 000 tokens en entrée et 500 en sortie avec Kimi K2 Thinking, d'après les prix publiés. Calcul LE LABO IA, hors cache et hors recherche web.

Concurrents directs

Le radar a sélectionné automatiquement des modèles comparables selon ses critères internes.

ModèleDisponibleEntréeSortieContexte1 000 requêtesTest vidéo
Kimi K2 Thinking06/11/20250,60 $2,50 $262 1442,45 $non
Palmyra X521/01/20260,60 $6,00 $1 040 0004,20 $non
GLM 4.722/12/20250,60 $2,20 $204 8002,30 $non
Kimi K2 090504/09/20250,60 $2,50 $262 1442,45 $non
GLM 4.5V11/08/20250,60 $1,80 $65 5362,10 $non
Qwen3 Coder Plus23/09/20250,65 $3,25 $1 000 0002,925 $non

Sélection automatique : même type de modèle, sorti à 90 jours près, prix d'entrée dans un rapport de 1 à 3. Prix en dollars par million de tokens, tels que publiés. La barre compare le coût de 1 000 requêtes au plus élevé du tableau.

Fiche complète

Éditeur
MoonshotAI
Famille
Kimi
Type
Texte
Identifiant API
moonshotai/kimi-k2-thinking
Entrées
texte
Sorties
texte
Entrée
0,60 $ par million de tokens
Sortie
2,50 $ par million de tokens
Lecture en cache
0,15 $ par million de tokens
Contexte
262 144 tokens
Sortie maximale
98 304 tokens
Fonctions
appel d'outils, raisonnement, sorties structurées
Dépôt Hugging Face
moonshotai/Kimi-K2-Thinking
Coupure des connaissances
non communiquée
Statut
Actif

Ce qu'on sait

  • Modalités, date de disponibilité et identifiant d'API (OpenRouter)
  • Prix publiés et leur unité (OpenRouter)
  • Fenêtre de contexte (OpenRouter)
  • Fonctions déclarées : appel d'outils, raisonnement, sorties structurées

Ce qu'on ne sait pas encore

  • Date de coupure des connaissances : non communiquée
  • Nombre de paramètres : non publié par la source
  • Scores de benchmark : le radar n'en affiche aucun sans source primaire

Pour aller plus loin

Chronologie Kimi (texte)

  1. Kimi K2 090504/09/2025
  2. Kimi K2 Thinking06/11/2025
  3. Kimi K2.527/01/2026
  4. Kimi K2.620/04/2026
  5. Kimi K2.7 Code12/06/2026
  6. Kimi K316/07/2026

Famille Kimi

Kimi K2 Thinking appartient à la famille Kimi développée par MoonshotAI.

Tous les modèles Kimi (6)

Comprendre

Utiliser

Suis chaque sortie dans le Radar IA

Crée ton compte gratuit sur LE SAS. Une fois ton démarrage terminé, tu accèdes au Radar IA, aux espaces ouverts de la communauté et à une sélection de cours gratuits.

Créer mon compte gratuit

Questions fréquentes

Quelles sont les capacités principales de Kimi K2 Thinking ?

Kimi K2 Thinking prend en charge l'appel d'outils, le raisonnement et la génération de sorties structurées. Selon la description publiée, il s'agit du modèle de raisonnement ouvert le plus avancé de Moonshot AI à ce jour, étendant la série K2 vers le raisonnement agentique sur de longues périodes.

Combien coûte l'utilisation de Kimi K2 Thinking ?

Le tarif est de 0,6 $ par million de tokens en entrée et de 2,5 $ par million de tokens en sortie. La lecture en cache coûte 0,15 $ par million de tokens. Ces prix sont publiés par la source OpenRouter au relevé du 25 septembre 2026.

Quelle est la taille de la fenêtre de contexte de Kimi K2 Thinking ?

La fenêtre de contexte de Kimi K2 Thinking est de 262 144 tokens. Le nombre maximal de tokens en sortie est fixé à 98 304 tokens. Ces limites définissent la quantité maximale d'informations que le modèle peut traiter et générer en une seule interaction.