Benchmark des modèles d'embedding open source pour RAG
NVIDIA Llama-Embed-Nemotron-8B domine en précision. En termes de coût, Google EmbeddingGemma-300m est environ 4x moins cher que Nemotron au prix d'une légère perte de précision. nDCG@3 : Gain cumulé actualisé normalisé à la coupure 3. Avec un document pertinent par requête, il vaut 1 / log2(rang + 1) lorsque le document de référence se classe…