Ekrem Sarı
Ekrem, AIMultiple'da yapay zeka araştırmacısı olup, akıllı otomasyon, GPU'lar, yapay zeka ajanları ve RAG çerçeveleri için LLMOps konularına odaklanmaktadır.
Profesyonel Deneyim
Yandex'te Değerlendirme Uzmanı olarak görev yaptığı süre boyunca, tescilli çerçeveler ve otomatik protokoller kullanarak arama sonuçlarını değerlendirdi. Aylık 10.000'den fazla sorgu üzerinde veri etiketleme, alaka düzeyi puanlaması ve kullanıcı amacı eşlemesi yoluyla kalite güvence testleri uygularken, makine öğrenimi geri bildirim döngülerini kullanarak performans izleme ve spam tespiti de dahil olmak üzere teknik değerlendirmeler gerçekleştirdi.Araştırma Alanı
AIMultiple'da araştırmaları, MLOps yaşam döngüsü ve uçtan uca yapay zeka sistemlerinin performansı ve kıyaslaması üzerine yoğunlaşmaktadır. Geri Alma Destekli Üretim (RAG) optimizasyonu, kapsamlı Büyük Dil Modeli (LLM) kıyaslaması ve ajan tabanlı yapay zeka çerçevelerinin tasarımı da dahil olmak üzere çok çeşitli projelere katkıda bulunmaktadır. Ekrem, doğruluk, verimlilik, API maliyeti ve ölçeklenebilirlik gibi kritik operasyonel ölçütler genelinde yapay zeka teknolojisi performansını ölçmek ve iyileştirmek için veri odaklı metodolojiler geliştirmede uzmanlaşmıştır. Analizi, gömme modelleri ve vektör veritabanları gibi temel bileşenlerden, yapay zeka ajanlarının dağıtımı için gerekli olan yüksek performanslı GPU ve bulut altyapısına kadar tüm teknoloji yığınını kapsamaktadır.Eğitim
Ekrem, Hacettepe Üniversitesi'nden lisans, Başkent Üniversitesi'nden yüksek lisans derecesine sahiptir.Ekrem Tarafından Son Makaleler
En İyi 60+ Bulut GPU Sağlayıcıları
Bulut GPU sağlayıcıları üç katmana ayrılır. Hiperölçekleyiciler, GPU kiralamayı birçok ürün arasında bir ürün olarak sunan geniş bulut platformları işletir. Uzman neocloud'lar, temel ürün olarak GPU ve yapay zeka altyapısına odaklanır. Topluluk pazar yerleri, genellikle yayınlanan fiyat aralığının tabanında, birçok küçük operatörden envanter toplar. Takip ettiğimiz 71 bulut GPU sağlayıcısı ve 14 seçilmiş GPU model…
En İyi 6 Ücretsiz Bulut GPU Hizmetinin Karşılaştırması
En iyi free GPU katmanı, kiralama ücretleriyle ayda yaklaşık $19 değerindedir ve sekiz platform kredi kartı olmadan gerçek bir GPU sunar. Bunlardan altısı, aylık free kullanımı sınırlandırır ve biz, bulut GPU fiyatlandırma verilerimizdeki her bir GPU için en ucuz güncel isteğe bağlı ücret üzerinden fiyatlandırdık. Her çubuk, aynı GPU süresinin kiralama maliyetidir; bir platformun aylık…
Yedekleme yazılımı karşılaştırması: Acronis vs NinjaOne vs Comet vs MSP360
NinjaOne Backup, Acronis Cyber Protect Cloud Backup, Comet Backup ve MSP360 Managed Backup ürünlerini aynı AWS altyapısında karşılaştırdık. Her satıcı, aynı 625.946 dosyalık / 50 GB iş yükünün dosya modunda yedeklemesini ve sistem diskinin tam imaj yedeklemesini çalıştırdı, ardından 15 GB'lık orta alt dizini geri yükledi. 50 GB / 625.946 dosyalık iş yükünde test edilen…
Vektör Veritabanı Boyutlandırma ve Seçim Hesaplayıcı
RAG için kendi kendine barındırılan bir vektör veritabanının arkasındaki pratik soru, hangi motorun belirli bir sunucuya uyduğu ve hangisini iş yükünün elediğidir. Aşağıdaki hesaplayıcı, aynı embedding'ler üzerinde eşleşen geri çağırma oranında çalıştırılan yedi kendi kendine barındırılan vektör veritabanına ait kıyaslama sonuçlarımızdan her ikisini de yanıtlıyor. Hesaplayıcının üst kısmındaki beş onay kutusu, beş yaygın RAG iş…
Felaket Kurtarma Kıyaslaması: Acronis vs Comet vs MSP360
Acronis Cyber Protect Cloud, Comet Backup ve MSP360 Managed Backup'ı felaket kurtarma konusunda kıyasladık. Her satıcı, aynı deterministik iş yükünü taşıyan canlı bir Windows Server 2022 ve canlı bir Ubuntu 24.04 sunucusunun imajını aldı; bir web servisi, 10.000 satırlık bir veritabanı ve 50 dosyadan oluşan bu iş yükü, fidye yazılımı tarzı bir felaket verileri şifreledikten…
E-Ticaret Kazıyıcısı: 6 Sağlayıcı Karşılaştırıldı
5 web veri sağlayıcısını 100 e-ticaret alan adında kıyasladık, her biri için 5 ile 5,000 eş zamanlı istekle 65.000 ürün ve arama sayfası çektik. Eş zamanlılık seviyelerinin ortalamasında, Decodo yaklaşık 7 saniye ile en hızlı medyan yanıtı kaydetti, başarı oranı %59 iken, Bright Data en yüksek başarı oranına (%76) ulaştı ve medyan yanıtı 16 saniyeydi.…
En İyi RAG Araçları, Çerçeveleri ve Kütüphaneleri
RAG, LLM yanıtlarını yalnızca modelin eğitim sırasında ezberledikleri yerine harici verilerle temellendirerek iyileştirir. Bir RAG sistemini oluşturan bileşenleri kıyasladık ve sonuçları, yığının her parçasını seçmeye yönelik pratik bir rehberle birlikte tek bir yerde topladık. Her RAG bileşeni için kıyaslama sonuçlarımıza, RAG yığını seçme rehberimize veya RAG temellerine bakın: nedir, nasıl çalışır ve nerede yer alır.…
Vektör Veritabanı Benchmark: RAG için 7 Açık Kaynak Motor
Yedi açık kaynak, kendi kendine barındırılan vektör veritabanını bir RAG pipeline'ının erişim katmanı olarak benchmark ettik; her biri aynı bge-m3 embedding'leri ve gerçek tıbbi ve teknik sorgular üzerinde teker teker çalıştırıldı, böylece veritabanı endeksi tek değişken oldu. İş yükü; doğruluk ve erişim kalitesinden hız, bellek, filtrelenmiş ve hibrit arama, oluşturma maliyeti ve canlı değişime kadar…
GPU Eşzamanlılık Kıyaslaması: H100 vs H200 vs B200 vs MI300X
Son 20 yılımı sistem düzeyinde hesaplama performansı optimizasyonuna odaklanarak geçirdim. En yeni NVIDIA GPU'larını, NVIDIA'nın H100, H200 ve B200'ü ile AMD'nin MI300X'i dahil olmak üzere eşzamanlılık ölçeklendirme analizi için kıyasladık. gpt-oss-20b modelini kullanan vLLM çerçevesi ile bu GPU'ların 1'den 512'ye kadar eşzamanlı istekleri nasıl işlediğini test ettik. Sistem çıkış verimini, sorgu başına çıkış hızını ve…
Text-to-SQL: LLM Doğruluk Karşılaştırması
Veri analizi için SQL'e 18 yıldır güveniyorum, danışmanlık günlerimden beri. Doğal dildeki soruları SQL'e çevirmek, verileri daha erişilebilir kılar ve teknik becerisi olmayanlar da dahil herkesin doğrudan veritabanlarıyla çalışmasına olanak tanır. Text-to-SQL kıyaslama metodolojimizi 35'ten fazla büyük dil modeli (LLM'ler) üzerinde, SQL komutu oluşturma performanslarını değerlendirmek için kullandık: LLM'ler sıklıkla dört tür hata yapar: hatalı…
AIMultiple Bülteni
Haftada 1 ücretsiz e-posta ile en son B2B teknoloji haberleri ve uzman içgörüler ile işletmenizi hızlandırın.