System One benchmarklarına eklenen en yeni model Kev-9B.
AIM System One Index
Karar modelleri olarak da bilinen System One modelleri, metni token token üretmek yerine tek geçişte her seçenek için bir olasılıkla birlikte tipli bir karar döndürür. AIM System One Index nasıl hesaplanır
System One Modelleri Sıralaması
System One modelleri AIM System One Index'e göre sıralanır.
# | Model | Endeks | AIM-Agentic-RAG doğruluğu (%) | AIM-AI-Bias skoru | AIM-Decision (%) | AIM-Decision görev başına süre (sn) | Medyan gecikme (ms) |
|---|---|---|---|---|---|---|---|
| 1 | Kev-9B System One modeli | 69 | 97.1 | - | 40 | 38.8 | 952 |
| 2 | Jev 1.13 System One modeli | 66 | 98.8 | 80.6 | 34 | 5.4 | 344 |
| 3 | Laya System One modeli | 25 | 50.6 | - | 0 | - | 200 |
AIM System One Index ve karar başına süre
Daha yukarı ve daha sol daha iyidir.
Fine-tune edilmiş ve orijinal
50 tarayıcı görevinden tamamlananlar, her fine-tune model kendi orijinal sürümüne karşı.
Benchmarklar tek tek
AIM-Decision
Aynı tarayıcı görevlerinde 50 görevden tamamlananlar.
AIM-Agentic-RAG
243 veritabanı yönlendirme sorusu.
AIM System One Index nasıl hesaplanır
AIM System One Index, her modelin AIM-Agentic-RAG ve AIM-Decision doğruluklarının ortalamasıdır.
Gecikme ve maliyet referans olarak gösterilir ve index'e sayılmaz.
AIM-AI-Bias sonuçları referans olarak gösterilir ve index'e sayılmaz.
API maliyetleri bize faturalanan tutarlardır. Kendi sunucumuzdaki modellerin (Kev-9B, Laya) maliyeti tam kullanımda donanım tahminidir; Kev-9B'nin gecikmesi GPU'suna giden SSH tünelini içerir.
Kullandığımız Benchmarklar
Son Güncellemeler
System One benchmarklarına en son eklenen modeller.
Kev-9B
System One benchmarklarına yeni model eklendi.
Jev 1.13
System One benchmarklarına yeni model eklendi.
Laya
System One benchmarklarına yeni model eklendi.