Yapay Zeka
Üretken yapay zeka, büyük dil modelleri, RAG, yönetişim çerçeveleri, MLOps uygulamaları ve yapay zeka donanımı da dahil olmak üzere yapay zeka üzerine pratik bilgiler, araştırmalar ve kıyaslama verilerini keşfedin. Yapay zeka ortamını şekillendiren temel araçlar, uygulama stratejileri ve kurumsal kullanım örnekleri hakkında bilgi edinin.
Yapay Zeka Keşfedin
Agentic RAG Benchmark: Multi-Database Routing Across 36 LLM's
36 büyük dil modelini veritabanları arası yönlendirme konusunda kıyasladık. Her model, doğal dilde bir soru ve paragraf düzeyinde tanımlanmış 11 SQL veritabanı alıyor, ardından herhangi bir SQL yazmadan önce hangi veritabanının yanıtı içerdiğine karar vermesi gerekiyor. 11 veritabanı, 80 BIRD-SQL adayından, tanım embedding'lerini kümeleyerek seçildi; böylece adaylar anlamsal olarak birbirine yakın ve gerçek isimleri db_01…
Text-to-SQL: LLM Doğruluk Karşılaştırması
36 büyük dil modelini 759 soru üzerinde BIRD-SQL'den çalıştırdık; her model, 11 aday arasından kendisinin belirlemesi gereken bir veritabanına karşı SQL yazdı. Ayrıştırılabilen her sorgu gerçek veritabanında çalıştırıldı ve sonuç kümesi BIRD'ün altın sorgusunun sonuç kümesiyle karşılaştırıldı. Eksik, hatalı biçimlendirilmiş ve yürütme hatası veren sorgular ıskalanmış olarak puanlandı. Her çalıştırma sıcaklık 0'da, zero-shot olarak ve…
Bulut GPU Kiralama Fiyat Endeksi
Yayınlanan bulut GPU kiralama fiyatlarını 17 model için 75 sağlayıcı genelinde izliyoruz; talep üzerine, spot ve rezerve edilmiş ücretleri kapsıyor. Son çıkan, üç grup arasında en büyük fiyat artışına sahiptir. Talep üzerine medyanı Ekim 2024'te GPU-saat başına $2,12'den Eylül 2026'da $4,72'ye yükseldi. Aynı dönemde Modern grup $1,35'ten $1,45'e ilerlerken Legacy $1,77'den $0,95'e geriledi. Her medyan,…
Reranker Benchmark: En İyi 8 Model Karşılaştırması
8 reranker modelini ~145k İngilizce Amazon yorumu üzerinde değerlendirerek yeniden sıralama aşamasının yoğun getirmeyi ne kadar iyileştirdiğini ölçtük. multilingual-e5-base ile ilk 100 adayı getirdik, her modelle yeniden sıraladık ve ilk 10 sonucu, her biri kaynak yorumundaki somut ayrıntılara atıfta bulunan 300 sorguya göre değerlendirdik. En iyi reranker Hit@1'i %62,67'ten %83,00'e yükseltti (+20.33pp). Metrikler açıklandı: ΔHit@1…
En İyi 30+ AI Çip Üreticisi: NVIDIA ve Rakipleri
AIMultiple’ın bulut GPU kıyaslamasını 4 farklı senaryoda 10 farklı GPU modeliyle çalıştırma deneyimimize dayanarak, bunlar veri merkezi iş yükleri için en iyi AI donanım şirketleridir. *Seçili AI çipi, her satıcıyı en iyi temsil eden parça, platform veya duyurulan projedir. Bazı girişler tek bir çip yerine sistemler, hizmetler veya lisanslanabilir IP'dir. Sıralama kategoriye göredir. Satıcılar, ilk…
Çok Modlu Yapay Zeka Modellerini Görsel Muhakeme Konusunda Karşılaştırın
Önde gelen 15 çok modlu yapay zeka modelini 200 görsel tabanlı soru kullanarak görsel muhakeme konusunda kıyasladık. Değerlendirme iki parkurdan oluşuyordu: veri görselleştirme yorumlamasını test eden 100 grafik anlama sorusu ve örüntü tanıma ile uzamsal muhakemeyi değerlendiren 100 görsel mantık sorusu. Tutarlı ve güvenilir sonuçlar sağlamak için her soru 5 kez çalıştırıldı. Test prosedürlerimizi öğrenmek…
Yapay Zekâda Önyargı: Örnekler ve Düzeltmenin 6 Yolu
İşletmeler, AI kullanım örneklerindeki faydalarını gördükçe AI'ya olan ilgi artıyor. Ancak, AI teknolojisine ilişkin geçerli endişeler var: Soru formatından kaynaklanabilecek herhangi bir önyargı olup olmadığını görmek için aynı soruları hem açık uçlu hem de çoktan seçmeli formatlarda test ettik. Açık uçlu sorular kullanıldığında modellerin önyargı sergileme eğiliminin daha az olduğunu, ancak sıralamada bir değişiklik olmadığını…
En İyi 70+ Bulut GPU Sağlayıcısı
Bulut GPU sağlayıcıları üç kademeye ayrılır. Hiperskalalar, GPU kiralamayı birçok ürün arasında tek bir ürün olarak sunan geniş bulut platformları işletir. Uzmanlaşmış neobulutlar, temel ürün olarak GPU ve yapay zeka altyapısına odaklanır. Topluluk pazar yerleri, çok sayıda küçük operatörden envanteri genellikle yayınlanan fiyat aralığının tabanında toplar. Sütun tanımları: Sıralama: Aboneler tablonun üst kısmında bağlantılı ve…
Büyük Multimodal Model'ler (LMM'ler) vs LLM'ler
Finansal akıl yürütme görevlerinde Büyük Multimodal Model'lerin (LMM'lerin) performansını özenle seçilmiş bir dataset kullanarak değerlendirdik. Yüksek kaliteli finansal örneklerin bir alt kümesini analiz ederek, model'lerin finans alanındaki multimodal verileri işleme ve bu verilerle akıl yürütme yeteneklerini değerlendiriyoruz. metodoloji bölümü kullanılan dataset ve değerlendirme framework'ü hakkında ayrıntılı bilgiler sunar. Büyük multimodal model'leri keşfedin ve bunları büyük…
LLM Kendi Kendine Barındırma için VRAM Hesaplayıcı
Bir LLM'yi kendi kendine barındırmak, çıkarımı operatörün kontrol ettiği donanımda, üçüncü taraf bir API aracılığıyla değil, çalıştırmak anlamına gelir; bu da maliyeti, veri kontrolünü ve gizlilik profilini değiştirir. Bir modelin hiç çalışıp çalışmayacağı belleğe bağlıdır. Hesaplayıcı, modele, hassasiyetine, bağlam uzunluğuna ve hedef donanıma bağlı olarak bir modelin yerel olarak çalıştırılması için gereken VRAM veya birleşik…