Gemini Embedding 2 : prix, contexte et alternatives
Mise à jour le 25 septembre 2026Source : OpenRouterGoogle
- Entrée
- 0,20 $par million de tokens
- Par image fournie
- 0,00 $par image
- Contexte
- 8 192tokens
- Sortie max
- 7 372tokens
- Disponible
- 20/05/2026via API
En bref
Gemini Embedding 2 est un modèle d'embeddings multimodal édité par Google, disponible depuis le 20 mai 2026. Il accepte 5 types d'entrées : audio, fichier, image, texte et vidéo, pour produire des vecteurs (embeddings). Selon la description publiée, il s'agit du premier modèle d'embeddings multimodal de Google, conçu pour mapper texte et images dans un espace vectoriel unifié destiné à la recherche sémantique et au RAG. Le prix d'entrée est de 0,2 $ par million de tokens, tandis que l'image fournie est facturée 0 $.
Concurrents directs
Le radar a identifié automatiquement des modèles similaires selon ses critères de sélection.
| Modèle | Disponible | Entrée | Sortie | Contexte | 1 000 requêtes | Test vidéo |
|---|---|---|---|---|---|---|
| Gemini Embedding 2 | 20/05/2026 | 0,20 $ | non publié | 8 192 | non publié | non |
| Gemini Embedding 2 Preview | 17/04/2026 | 0,20 $ | non publié | 8 192 | non publié | non |
| voyage-code-4 | 13/08/2026 | 0,12 $ | non publié | 32 000 | non publié | non |
| voyage-4-large | 27/07/2026 | 0,12 $ | non publié | 32 000 | non publié | non |
| voyage-multimodal-3.5 | 27/07/2026 | 0,12 $ | non publié | 32 000 | non publié | non |
Sélection automatique : même type de modèle, sorti à 90 jours près, prix d'entrée dans un rapport de 1 à 3. Prix en dollars par million de tokens, tels que publiés. La barre compare le coût de 1 000 requêtes au plus élevé du tableau.
Fiche complète
- Éditeur
- Famille
- Gemini
- Type
- Embeddings
- Identifiant API
google/gemini-embedding-2- Entrées
- audio, fichier, image, texte, vidéo
- Sorties
- vecteurs
- Entrée
- 0,20 $ par million de tokens
- Par image fournie
- 0,00 $ par image
- Contexte
- 8 192 tokens
- Sortie maximale
- 7 372 tokens
- Fonctions
- aucune déclarée par la source
- Dépôt Hugging Face
- aucun dépôt référencé
- Coupure des connaissances
- non communiquée
- Statut
- Actif
- Variantes
google/gemini-embedding-2:batch
Ce qu'on sait
- Modalités, date de disponibilité et identifiant d'API (OpenRouter)
- Prix publiés et leur unité (OpenRouter)
- Fenêtre de contexte (OpenRouter)
Ce qu'on ne sait pas encore
- Date de coupure des connaissances : non communiquée
- Nombre de paramètres : non publié par la source
- Scores de benchmark : le radar n'en affiche aucun sans source primaire
Pour aller plus loin
Générations de la gamme
- Gemini Embedding 00131/10/2025
- Gemini Embedding 220/05/2026
Chronologie Gemini (embeddings)
- Gemini Embedding 00131/10/2025
- Gemini Embedding 2 Preview17/04/2026
- Gemini Embedding 220/05/2026
Famille Gemini
Gemini Embedding 2 fait partie de la famille Gemini développée par Google.
- Gemini 3.5 Transcribe dès 2,00 $ par million de tokens
- Gemini 3.8 Flash TTS 0,50 $ par million de tokens de texte
- Gemini 3.8 Flash Lite TTS 0,50 $ par million de tokens de texte
- Gemini 3.8 Flash 0,75 $ / 3,75 $
Comprendre
Utiliser
Suis chaque sortie dans le Radar IA
Crée ton compte gratuit sur LE SAS. Une fois ton démarrage terminé, tu accèdes au Radar IA, aux espaces ouverts de la communauté et à une sélection de cours gratuits.
Questions fréquentes
Quels types d'entrées Gemini Embedding 2 accepte-t-il ?
Gemini Embedding 2 accepte 5 types d'entrées distincts : audio, fichier, image, texte et vidéo. Ces données sont transformées en vecteurs (embeddings) en sortie.
Combien coûte l'utilisation de Gemini Embedding 2 ?
Le tarif publié par la source indique un coût d'entrée de 0,2 $ par million de tokens. Pour les images fournies, le prix est de 0 $ par image.
Quelle est la taille de contexte de Gemini Embedding 2 ?
La fenêtre de contexte de Gemini Embedding 2 est de 8192 tokens. La limite maximale de tokens en sortie est fixée à 7372 tokens.
À quoi sert principalement Gemini Embedding 2 ?
Selon la description publiée, ce modèle sert à mapper le texte et les images dans un espace vectoriel unifié, facilitant ainsi la recherche sémantique et la génération augmentée par récupération (RAG).