Berk Kalelioğlu
Interessi di ricerca
Berk si concentra su machine learning, strumenti di AI agentica e large e small language models (LLM e SLM).Fa parte del team di benchmark di AIMultiple, conducendo valutazioni e fornendo approfondimenti per aiutare i lettori a comprendere le tecnologie emergenti e le loro applicazioni nel mondo reale.
Esperienza professionale
Ha iniziato la sua carriera come Tech Project Lead presso ODTU IVME-R, dove ha guidato un progetto per costruire generatori fisici di numeri quantistici e pseudocasuali.Dopo il suo periodo presso IVME-R, ha co-fondato una società di sviluppo di giochi e ha pubblicato un gioco su Steam.
In seguito ha orientato la sua carriera verso l'AI ed è entrato in AIMultiple come Ricercatore.
Formazione
Berk possiede una laurea triennale in Matematica presso l'Università di Ankara.Ultimi articoli di Berk
A-CODE-LLM Bench: Benchmark di Codifica Agentica
Abbiamo confrontato i migliori Large Language Models (LLMs) su 10 compiti di sviluppo software utilizzando uno strumento CLI agentico. Abbiamo eseguito circa 3.500 passaggi di validazione automatizzati per modello su entrambi i livelli API e UI. Risultati del benchmark A-CODE-LLM Ogni alias è stato eseguito 3 volte su 10 compiti (30 campioni per alias, 380…
A-CODE-CLI Bench: Benchmark CLI Agentici
Gli strumenti CLI agentici sono strumenti di codifica IA che possono creare ed eliminare file, eseguire comandi, pianificare ed eseguire la codifica dell'intero progetto. Abbiamo sottoposto a benchmark i principali strumenti in 10 scenari reali di sviluppo web, eseguendo ~600 controlli di validazione atomici per agente e più di ~5.000 esecuzioni totali di test automatizzati,…
Benchmark Modelli Tabulari: Prestazioni su 19 Dataset
Abbiamo valutato 7 modelli di apprendimento tabulare ampiamente utilizzati su 19 dataset reali, coprendo circa 260.000 campioni e oltre 250 feature totali, con dimensioni dei dataset che variano da 435 a quasi 49.000 righe. Il nostro obiettivo era comprendere le famiglie di modelli migliori per dataset di diverse dimensioni e strutture (ad es. numerico vs.…
Moltbook: Social Media Guidata da Agenti
La rapida crescita di OpenClaw ha innescato un insolito esperimento sociale: Moltbook, una piattaforma sociale simile a Reddit dove gli agenti interagiscono tra loro. Lanciato il 28 gennaio 2026, ha iniziato ad attirare l'attenzione in breve tempo. Ha raggiunto oltre 1,5 milioni di agenti nella sua prima settimana. Per ulteriori piattaforme per agenti AI, leggi…
Casi d'uso e sicurezza di OpenClaw (Moltbot/Clawdbot)
OpenClaw (precedentemente Moltbot e Clawdbot) è un assistente AI open-source e self-hosted progettato per eseguire compiti di calcolo locali e interfacciarsi con gli utenti tramite piattaforme di messaggistica standard. A differenza dei chatbot tradizionali che funzionano come consulenti generando testo, OpenClaw opera come un agente autonomo in grado di eseguire comandi shell, gestire file e…
Confronto VPS: Hetzner vs Digital Ocean
Abbiamo confrontato 6 fornitori di Virtual Private Server (VPS) eseguendo circa 1.200 test automatizzati per server su CPU, memoria, I/O del disco e velocità di rete utilizzando sysbench, fio e speedtest-cli. Abbiamo anche documentato l'intera esperienza dall'iscrizione all'accesso SSH per ciascun fornitore. Risultati del confronto VPS Abbiamo utilizzato piani da 4 vCPU (condivisi) / 8…
Newsletter AI Multiple
Una email gratuita a settimana con le ultime notizie tecnologiche B2B e approfondimenti di esperti per dare impulso alla tua azienda.