Services
Contactez-nous

Benchmarks d'Embeddings

Des benchmarks transparents de modèles d'embeddings fondés sur les propres évaluations de recherche d'AIMultiple portant sur des modèles d'embeddings commerciaux et open source dans trois domaines RAG d'entreprise. Voir la méthodologie.

MEILLEUR MODÈLE
voyage-3.5
nDCG@3 0.943
Meilleur rapport qualité-prix
pplx-0.6b
$0.0040 / 1M
Plus grand modèle
KaLM-Gemma3-12B
11.8B paramètres
Couverture
29 modèles
3 domaines de recherche · 87 évaluations
Benchmarks des modèles d'embeddings (nDCG@3)

Classement

Tous les modèles d'embeddings évalués, classés par leur moyenne nDCG@3 sur trois domaines.

Filtrer et trier
#
Modèle
nDCG@3
CUAD (legal)
TechQA (support)
MedRAG (health)
1
voyage-3.5
voyage-3.5
Voyage AI
0.943
0.9100.9650.954
2
voyage-4-large
voyage-4-large
Voyage AI
0.942
0.8730.9660.986
3
gemini-2-preview
gemini-2-preview
Google
0.932
0.8960.9300.969
4
nvidia-nemotron-8b
nvidia-nemotron-8b
NVIDIA
0.925
0.8600.9520.963
5
gemini-001
gemini-001
Google
0.922
0.8980.8860.981
6
voyage-4-lite
voyage-4-lite
Voyage AI
0.921
0.8590.9480.956
7
voyage-law-2
voyage-law-2
Voyage AI
0.919
0.9130.9020.941
8
SFR-Embedding-2_R
SFR-Embedding-2_R
Salesforce
0.905
0.8420.9110.962
9
jina-v5-text-small
jina-v5-text-small
Jina AI
0.895
0.8360.8970.952
10
harrier-oss-0.6b
harrier-oss-0.6b
Microsoft
0.891
0.8720.8410.961
Page 1 sur 3

Prix$0.060
Paramètres-
SortieMai 2025
CUAD (legal)
0.91
TechQA (support)
0.965
MedRAG (health)
0.954

Prix$0.120
Paramètres-
SortieJan 2026
CUAD (legal)
0.873
TechQA (support)
0.966
MedRAG (health)
0.986

Prix$0.200
Paramètres-
SortieMar 2026
CUAD (legal)
0.896
TechQA (support)
0.93
MedRAG (health)
0.969

Prix$0.022
Paramètres7.5B
SortieOct 2025
CUAD (legal)
0.86
TechQA (support)
0.952
MedRAG (health)
0.963

Prix$0.150
Paramètres-
SortieJuil 2025
CUAD (legal)
0.898
TechQA (support)
0.886
MedRAG (health)
0.981

Prix$0.020
Paramètres-
SortieJan 2026
CUAD (legal)
0.859
TechQA (support)
0.948
MedRAG (health)
0.956

Prix$0.120
Paramètres-
SortieAvr 2024
CUAD (legal)
0.913
TechQA (support)
0.902
MedRAG (health)
0.941

Prix$0.041
Paramètres7.1B
SortieJuin 2024
CUAD (legal)
0.842
TechQA (support)
0.911
MedRAG (health)
0.962

Prix$0.0066
Paramètres1.6B
SortieAvr 2026
CUAD (legal)
0.836
TechQA (support)
0.897
MedRAG (health)
0.952

Prix$0.012
Paramètres596M
SortieMar 2026
CUAD (legal)
0.872
TechQA (support)
0.841
MedRAG (health)
0.961
Page 1 sur 3
Benchmarks des modèles d'embeddings par date de sortie
nDCG@3 en fonction de la date de sortie de chaque modèle
Prix et précision de recherche
Coût effectif en fonction du nDCG@3. Les modèles commerciaux sont valorisés au tarif public de leur API, les modèles auto-hébergés au coût GPU amorti de leur exécution sur une seule H100.
Méthodologie

Comment les benchmarks des modèles d'embeddings sont construits

Les benchmarks des modèles d'embeddings notent chaque modèle avec le nDCG@3, la part des requêtes pour lesquelles le bon document figure dans les 3 premiers résultats, et font la moyenne de son classement sur les trois domaines de recherche où il a été évalué. Chaque benchmark ci-dessous alimente ce score.

Mises à jour récentes

Mises à jour récentes

Derniers changements apportés aux Benchmarks des modèles d'embeddings, à la couverture des modèles et à la méthodologie de benchmark d'AIMultiple.

Jina AI

jina-v5-text-small

Nouveau modèle ajouté aux Benchmarks des modèles d'embeddings.

Microsoft

harrier-oss-0.6b

Nouveau modèle ajouté aux Benchmarks des modèles d'embeddings.

Google

gemini-2-preview

Nouveau modèle ajouté aux Benchmarks des modèles d'embeddings.

Voyage AI

voyage-4-large

Nouveau modèle ajouté aux Benchmarks des modèles d'embeddings.

Explorez Embeddings

Modèles embedding: OpenAI vs Gemini vs Voyage

Embeddings
Benchmark
31 Août

Nous avons évalué 15 modèles d’embedding de texte en anglais et une référence BM25 sur plus de 500 requêtes sélectionnées manuellement dans trois domaines de recherche : contrats juridiques (CUAD), support client (IBM TechQA) et santé (MedRAG PubMed). Voyage-3.5 se classe premier au classement général. Perplexity Embed V1 0.6b atteint le segment intermédiaire supérieur au…

En savoir plus