Benchmark der Open-Source-Embedding-Modelle für RAG
NVIDIA Llama-Embed-Nemotron-8B führt bei der Genauigkeit. Bei den Kosten läuft Googles EmbeddingGemma-300m etwa 4x günstiger als Nemotron, bei einem kleinen Genauigkeitsverlust. nDCG@3: Normalisierter diskontierter kumulativer Gewinn bei Cutoff 3. Bei einem relevanten Dokument pro Abfrage beträgt er 1 / log2(Rang + 1), wenn das Golddokument unter den Top 3 landet, andernfalls 0. Rang 1 erzielt…