Hizmetler
Bize Ulaşın
Berk Kalelioğlu

Berk Kalelioğlu

Yapay Zeka Araştırmacısı
13 Makale
B2B Teknolojisinde Güncel Kalın
Berk, AIMultiple'da yapay zeka araştırmacısıdır. Oyun geliştirme ve kaotik sistemler kullanarak sözde rastgele sayı üreteçleri geliştirme konusunda önceden deneyime sahiptir.

Araştırma ilgi alanları

Berk, makine öğrenimi, etmen tabanlı yapay zeka araçları ve büyük ve küçük dil modelleri (LLM'ler ve SLM'ler) üzerine odaklanmaktadır.

Kendisi, AIMultiple benchmark ekibinin bir parçasıdır; değerlendirmeler yapmakta ve okuyucuların yeni gelişen teknolojileri ve gerçek dünyadaki uygulamalarını anlamalarına yardımcı olacak içgörüler sunmaktadır.

Profesyonel deneyim

Kariyerine ODTU IVME-R'de Teknoloji Proje Lideri olarak başladı ve burada fiziksel kuantum ve sözde rastgele sayı üreteçleri geliştirme projesine liderlik etti.

IVME-R'deki görevinden sonra bir oyun geliştirme şirketi kurdu ve Steam'de bir oyun yayımladı.

Daha sonra kariyerini yapay zekaya yöneltti ve AIMultiple'a Araştırmacı olarak katıldı.

Eğitim

Berk, Ankara Üniversitesi'nden matematik alanında lisans derecesine sahiptir.

Berk Tarafından Son Makaleler

Otonom Yapay Zeka
Özellik Karşılaştırması
3 Eyl

OpenClaw Alternatifleri: Hermes vs ZeroClaw vs Grok Bot

Otonom yapay zeka ajanları, OpenClaw ve Hermes agent gibi, normalde sürekli insan girdisi gerektirecek çok adımlı görevleri otomatikleştirir. OpenClaw en yaygın benimsenen her zaman açık otonom ajan haline gelmiş olsa da, birçok kullanıcı zorlu dağıtım süreci ve karmaşık yapılandırma gereksinimleri nedeniyle alternatifler aramaktadır. OpenClaw'ın otonom görev yürütme yaklaşımından nasıl farklılaştıklarını vurgulayarak önde gelen 5 OpenClaw…

Otonom Yapay Zeka
Kıyaslama
31 Ağu

Bilgisayar Kullanım Ajanları: Kıyaslama & Mimari

Bilgisayar kullanım ajanları gerçek masaüstlerinde ve web uygulamalarında çalışır. Tasarımları, sınırları ve ödünleri genellikle belirsizdir. Önde gelen sistemlerin nasıl çalıştığını, nasıl öğrendiklerini ve mimarilerinin nasıl farklılaştığını inceliyoruz. Ayrıca, 100 masaüstü ekran görüntüsü üzerinde, 4 görev türü ve her örnek için 5 çalıştırma ile odaklanmış bir UI temellendirme kıyaslamasına atıfta bulunuyoruz. Bu kıyaslama, görsel algı kalitesini…

Otonom Yapay Zeka
Kıyaslama
27 Ağu

AI VC Benchmark: 11 AI Ajanı Gerçek Girişim Sermayesi Görevlerinde

Erken aşama VC’lerle ortaklık kurarak iki analist iş akışını insan tarafından doğrulanmış altın standartlı karşılaştırmalara dönüştürdük ve 11 AI ajanını bunlarla puanladık. Görevleri, sonuçları ve puanlama yöntemini görün: 11 modelin her biri her görevi bir kez çalıştırdı. Puanlar 100 üzerindendir. Kimi K3 puanlanabilir fırsat belirleme çalışması üretemedi ve 0 olarak kaydedildi. Her iki görev de…

Yapay Zeka
Kıyaslama
24 Ağu

AIM Enterprise: Ajansal Kurumsal Kıyaslama

İşletmeler düzenli görevleri için her gün LLM'ler kullanır. En uygun maliyetli LLM'leri bulmak için, strateji, pazarlama, İK, satış ve operasyonlar genelinde 69 gerçek kurumsal görev kullandığımız ajansal bir kurumsal kıyaslama olan AIM Enterprise'ı tasarladık. İki hakem model her dosyayı puanladı ve sıklıkla uyuşmazlığa düştü. Bireysel puanların yaklaşık üçte birinde ikisi, ölçeğin dörtte birinden fazla ayrıştı…

Otonom Yapay Zeka
Kıyaslama
24 Ağu

MCP Gateway Karşılaştırması: 6 Gateway'in Gecikme ve Güvenliği

Bir MCP gateway, bir yapay zeka ajanı ile onun çağırdığı araçlar arasında yer alır ve satıcılar onu bu trafik için güvenlik katmanı olarak konumlandırır. Altı MCP gateway'i, tek bir makinede enstrümante edilmiş tek bir arka uca karşı kıyasladık; eklenen gecikmeyi, araç bazında yetkilendirmeyi, içerik korumasını ve denetim bütünlüğünü ölçtük. Bir ürün yalnızca ilgili kontrol ürünle…

Yapay Zeka24 Ağu

Zaman Serisi Sınıflandırma Karşılaştırması: Temel Modeller ve Klasik Yöntemler

13 zaman serisi sınıflandırma yöntemini, önceden eğitilmiş zaman serisi temel modellerinden 2019'dan 22 özellikli bir temel modele kadar, donmuş bir protokol altında 33 UCR/UEA veri seti üzerinde karşılaştırdık. Bu, 14.638 kayıtlı yöntem-veri seti-yeniden örnekleme hücresidir; bunların 11.874 kadarı puanlanmıştır. Grafik, her birinin tamamladığı 15 tek değişkenli veri setinde 12 yöntemi karşılaştırıyor; her veri seti aynı…

Otonom Yapay Zeka
Kıyaslama
21 Ağu

A-CODE-CLI Bench: Agentic CLI Benchmark

Ajan CLI araçları, dosya oluşturup silebilen, komut çalıştırabilen, plan yapabilen ve tüm projenin kodlamasını yürütebilen yapay zeka kodlama araçlarıdır. Önde gelen araçları 10 gerçek dünya web geliştirme senaryosunda kıyasladık; ajan başına ~600 atomik doğrulama kontrolü ve backend mantığı, frontend işlevselliği ve çoklu çalıştırma tutarlılık doğrulaması dahil toplamda ~5.000'den fazla otomatik test yürütmesi gerçekleştirdik. Backend doğruluğu…

Kurumsal Yazılım
Kıyaslama
21 Ağu

VPS Karşılaştırması: Hetzner vs Digital Ocean

6 Sanal Özel Sunucu (VPS) sağlayıcısını, CPU, bellek, disk G/Ç ve ağ hızında sysbench, fio ve speedtest-cli kullanarak sunucu başına ~1.200 otomatik test çalıştırarak karşılaştırdık. Ayrıca her sağlayıcı için kayıttan SSH'a kadar olan tüm deneyimi belgeledik. Her sağlayıcının 4 vCPU (Paylaşımlı) / 8 GB planlarını, herhangi bir ekstra veya hizmet eklemeden kullandık. En ucuz sağlayıcılar…

Otonom Yapay Zeka
Kıyaslama
19 Ağu

A-CODE-LLM Bench: Ajansal Kodlama Kıyaslaması

En iyi Büyük Dil Modellerini (LLM'leri) 10 yazılım geliştirme görevinde ajan bir CLI aracı kullanarak kıyasladık. Her modelde hem API hem de UI katmanlarında ~3.500 otomatik doğrulama adımı çalıştırdık. Her takma ad 10 görevde 3 kez çalıştırıldı (takma ad başına 30 örnek, 40 takma ad genelinde iterasyon başına 400 hücre). Daha fazla ayrıntı için metodoloji…

Otonom Yapay Zeka
Kıyaslama
19 Ağu

AIM Ajan Tabanlı Pazarlama Benchmark

AIM Ajan Tabanlı Pazarlama benchmark'ını tanıtıyoruz; bu benchmark, ajan performansını üç pazarlama iş akışında ölçer: rekabet boşluğu analizi, ABM hedef listesi hazırlama ve kişiselleştirilmiş satış sunumu. Ayrıca ajanların AIMultiple’ın İngilizce içeriğini incelediği ve okuyucuların güvenini sarsabilecek olgusal doğruluk, alıntılar, tutarlılık, güncellik, işlevsellik, dil bilgisi ve biçimlendirme ile ilgili doğrulanabilir sorunları raporladığı ayrı bir web sitesi…