Qwen3 Embedding 4B : prix, contexte et alternatives
Mise à jour le 25 septembre 2026Source : OpenRouterQwen
- Entrée
- 0,02 $par million de tokens
- Contexte
- 32 768tokens
- Sortie max
- 29 491tokens
- Disponible
- 28/10/2025via API
En bref
Qwen3 Embedding 4B est un modèle d'embeddings édité par Qwen, disponible depuis le 28 octobre 2025. Il traite des entrées de type texte pour produire des vecteurs (embeddings). Sa fenêtre de contexte s'élève à 32768 tokens, avec une sortie maximale de 29491 tokens. Le prix affiché est de 0,02 $ par million de tokens en entrée. Selon la description publiée, cette série constitue le dernier modèle propriétaire de la famille Qwen, conçu spécifiquement pour les tâches d'embedding et de classement de texte.
Concurrents directs
Le radar a sélectionné automatiquement plusieurs modèles concurrents basés sur des critères techniques et tarifaires similaires.
| Modèle | Disponible | Entrée | Sortie | Contexte | 1 000 requêtes | Test vidéo |
|---|---|---|---|---|---|---|
| Qwen3 Embedding 4B | 28/10/2025 | 0,02 $ | non publié | 32 768 | non publié | non |
| Text Embedding 3 Small | 30/10/2025 | 0,02 $ | non publié | 8 192 | non publié | non |
| bge-large-en-v1.5 | 18/11/2025 | 0,01 $ | non publié | 512 | non publié | non |
| bge-m3 | 18/11/2025 | 0,01 $ | non publié | 8 194 | non publié | non |
| E5-Large-v2 | 18/11/2025 | 0,01 $ | non publié | 512 | non publié | non |
| Multilingual-E5-Large | 18/11/2025 | 0,01 $ | non publié | 512 | non publié | non |
Sélection automatique : même type de modèle, sorti à 90 jours près, prix d'entrée dans un rapport de 1 à 3. Prix en dollars par million de tokens, tels que publiés. La barre compare le coût de 1 000 requêtes au plus élevé du tableau.
Fiche complète
- Éditeur
- Qwen
- Famille
- Qwen
- Type
- Embeddings
- Identifiant API
qwen/qwen3-embedding-4b- Entrées
- texte
- Sorties
- vecteurs
- Entrée
- 0,02 $ par million de tokens
- Contexte
- 32 768 tokens
- Sortie maximale
- 29 491 tokens
- Fonctions
- aucune déclarée par la source
- Dépôt Hugging Face
- Qwen/Qwen3-Embedding-4B
- Coupure des connaissances
- non communiquée
- Statut
- Actif
Ce qu'on sait
- Modalités, date de disponibilité et identifiant d'API (OpenRouter)
- Prix publiés et leur unité (OpenRouter)
- Fenêtre de contexte (OpenRouter)
Ce qu'on ne sait pas encore
- Date de coupure des connaissances : non communiquée
- Scores de benchmark : le radar n'en affiche aucun sans source primaire
Pour aller plus loin
Chronologie Qwen (embeddings)
- Qwen3 Embedding 4B28/10/2025
- Qwen3 Embedding 8B28/10/2025
Famille Qwen
Qwen3 Embedding 4B fait partie de la gamme Qwen, une série de modèles propriétaires dédiés aux tâches d'embedding et de classement.
- Qwen3.8 Max Prime 4,00 $ / 12,00 $
- Qwen3.8 Omni Flash 0,15 $ / 0,47 $
- Qwen3.8 Max 2,00 $ / 6,00 $
- Qwen3.8 Flash 0,15 $ / 0,47 $
Comprendre
Utiliser
Suis chaque sortie dans le Radar IA
Crée ton compte gratuit sur LE SAS. Une fois ton démarrage terminé, tu accèdes au Radar IA, aux espaces ouverts de la communauté et à une sélection de cours gratuits.
Questions fréquentes
Quelles sont les capacités d'entrée et de sortie de Qwen3 Embedding 4B ?
Qwen3 Embedding 4B accepte 1 type d'entrée, à savoir du texte. En sortie, il génère des vecteurs (embeddings). La limite de tokens en entrée est fixée à 32768, tandis que la longueur maximale de la sortie atteint 29491 tokens.
Combien coûte l'utilisation de Qwen3 Embedding 4B ?
Le tarif publié par la source pour Qwen3 Embedding 4B est de 0,02 $ par million de tokens en entrée. Aucune information sur un coût de sortie n'est communiquée à la date de vérification.
Depuis quand Qwen3 Embedding 4B est-il accessible ?
Qwen3 Embedding 4B est disponible depuis le 28 octobre 2025. À la date de vérification du 25 septembre 2026, aucune date de fin de service n'a été annoncée par la source.