• Remplacé
  • Texte
  • Entrées audio, fichier, image, texte, vidéo

Gemini 3.5 Flash : prix, contexte et alternatives

Mise à jour le 25 septembre 2026Source : OpenRouterGoogle

Entrée
1,50 $par million de tokens
Sortie
9,00 $par million de tokens
Contexte
1 048 576tokens
Sortie max
65 536tokens
Disponible
19/05/2026via API

En bref

Gemini 3.5 Flash est un modèle multimodal édité par Google, disponible depuis le 19 mai 2026. Il accepte 5 types d'entrées : audio, fichier, image, texte et vidéo, et produit du texte. Selon la description publiée, il offre des capacités de codage et de raisonnement proches du niveau Pro à coût réduit. Le prix s'élève à 1,5 $ par million de tokens en entrée et 9 $ par million de tokens en sortie. Une variante batch existe.

Repère de coût

7,50 $

pour 1 000 requêtes de 2 000 tokens en entrée et 500 en sortie avec Gemini 3.5 Flash, d'après les prix publiés. Calcul LE LABO IA, hors cache et hors recherche web.

Concurrents directs

Le radar a sélectionné automatiquement des modèles comparables selon le type, la date de sortie et le rapport de prix d'entrée.

ModèleDisponibleEntréeSortieContexte1 000 requêtesTest vidéo
Gemini 3.5 Flash19/05/20261,50 $9,00 $1 048 5767,50 $non
Mistral Medium 3.530/04/20261,50 $7,50 $262 1446,75 $non
Qwen3.7 Max21/05/20261,475 $4,425 $1 000 0005,1625 $non
GPT-5.3-Codex24/02/20261,75 $14,00 $400 00010,50 $non
Muse Spark 1.205/08/20261,25 $4,25 $1 048 5764,625 $non
Muse Spark 1.116/07/20261,25 $4,25 $1 048 5764,625 $non

Sélection automatique : même type de modèle, sorti à 90 jours près, prix d'entrée dans un rapport de 1 à 3. Prix en dollars par million de tokens, tels que publiés. La barre compare le coût de 1 000 requêtes au plus élevé du tableau.

Fiche complète

Éditeur
Google
Famille
Gemini
Type
Texte
Identifiant API
google/gemini-3.5-flash
Entrées
audio, fichier, image, texte, vidéo
Sorties
texte
Entrée
1,50 $ par million de tokens
Sortie
9,00 $ par million de tokens
Lecture en cache
0,15 $ par million de tokens
Écriture en cache
0,083333 $ par million de tokens
Raisonnement interne
9,00 $ par million de tokens
Par image fournie
0,000002 $ par image
Par recherche web
0,014 $ par recherche
Contexte
1 048 576 tokens
Sortie maximale
65 536 tokens
Fonctions
appel d'outils, raisonnement, sorties structurées
Dépôt Hugging Face
aucun dépôt référencé
Coupure des connaissances
1er janvier 2025
Statut
Remplacé : génération plus récente, Gemini 3.8 Flash
Variantes
google/gemini-3.5-flash:batch

Ce qu'on sait

  • Modalités, date de disponibilité et identifiant d'API (OpenRouter)
  • Prix publiés et leur unité (OpenRouter)
  • Fenêtre de contexte (OpenRouter)
  • Fonctions déclarées : appel d'outils, raisonnement, sorties structurées

Ce qu'on ne sait pas encore

  • Nombre de paramètres : non publié par la source
  • Scores de benchmark : le radar n'en affiche aucun sans source primaire

Pour aller plus loin

Générations de la gamme

  1. Gemini 2.5 Flash17/06/2025
  2. Gemini 3.5 Flash19/05/2026
  3. Gemini 3.6 Flash21/07/2026
  4. Gemini 3.7 Flash13/08/2026
  5. Gemini 3.8 Flash02/09/2026

Famille Gemini

Gemini 3.5 Flash succède aux générations précédentes de la gamme Gemini chez Google, avec une version plus récente nommée Gemini 3.8 Flash.

Tous les modèles Gemini (27)

Comprendre

Utiliser

Suis chaque sortie dans le Radar IA

Crée ton compte gratuit sur LE SAS. Une fois ton démarrage terminé, tu accèdes au Radar IA, aux espaces ouverts de la communauté et à une sélection de cours gratuits.

Créer mon compte gratuit

Questions fréquentes

Combien coûte Gemini 3.5 Flash ?

L'entrée coûte 1,5 $ par million de tokens et la sortie 9 $ par million de tokens. La lecture en cache est facturée 0,15 $ par million de tokens, tandis que l'écriture en cache coûte 0,083333 $ par million de tokens. Chaque image fournée revient à 0,000002 $ et chaque recherche web à 0,014 $.

Quelles sont les limites de contexte de Gemini 3.5 Flash ?

Le modèle dispose d'une fenêtre de contexte de 1 048 576 tokens. La longueur maximale de la sortie générée est fixée à 65 536 tokens. Ces valeurs définissent la capacité de traitement des informations longues pour ce modèle spécifique.

Quelles fonctionnalités propose Gemini 3.5 Flash ?

Gemini 3.5 Flash prend en charge l'appel d'outils, le raisonnement interne et la production de sorties structurées. Ces fonctionnalités permettent au modèle d'interagir avec des systèmes externes, de traiter des tâches logiques complexes et de formater ses réponses selon des schémas précis.

Quelle est la date de coupure des connaissances de Gemini 3.5 Flash ?

La date de coupure des connaissances de Gemini 3.5 Flash est le 1er janvier 2025. Les détails sur les données incluses ou exclues après cette date ne sont pas communiqués.