Premium
Servizi
Premium
Ekrem Sarı

Ekrem Sarı

Ricercatore IA
37 Articoli
Rimani aggiornato sulle novità tecnologiche B2B.

Ekrem è un Ricercatore IA e Data Scientist presso AIMultiple. Progetta ed esegue benchmark pratici per sistemi di IA e LLM.

Esperienza professionale

Presso AIMultiple, Ekrem esegue benchmark su sistemi di IA end-to-end e realizza i flussi di lavoro dei dati e le dashboard utilizzate per monitorare le metriche di benchmark e di prodotto. I suoi benchmark coprono modelli di embedding e reranker, database vettoriali e a grafo, motori di inference, quantizzazione, concorrenza GPU e scaling multi-GPU, prezzi e provider di GPU cloud, text-to-SQL e framework RAG e RAG agentici.

Prima di AIMultiple, ha lavorato come Data Scientist presso Yandex, dove ha interrogato e analizzato grandi dataset con SQL per valutare la qualità di ricerca e ranking rispetto a linee guida dettagliate.

Interessi di ricerca

Il lavoro di Ekrem si concentra sulla misurazione delle prestazioni pratiche dei sistemi LLM e di retrieval. Progetta il test harness, esegue i carichi di lavoro su hardware reale e confronta modelli, framework e infrastrutture in termini di accuratezza, throughput, latenza, costo e scalabilità, lungo l'intero stack dai modelli di embedding e database vettoriali ai motori di inference e all'infrastruttura GPU. La sua tesi di laurea magistrale automatizza le revisioni sistematiche della letteratura con una pipeline basata su RAG.

Formazione

Ekrem ha conseguito una laurea magistrale in Sistemi Informativi Gestionali presso la Başkent University, dove la sua tesi ha automatizzato le revisioni sistematiche della letteratura con una pipeline basata su RAG, e sta conseguendo una seconda laurea magistrale in Ingegneria dei Dati e della Conoscenza presso la Hacettepe University.

Ultimi articoli di Ekrem

IA
Benchmark
23 set

Benchmark di RAG agentica: instradamento tra 11 database SQL

L'accuratezza di instradamento è la percentuale di domande valutate per cui il modello nomina esplicitamente il database corretto nella risposta finale. Il risultato principale utilizza le 184 domande contrassegnate come difficili sia dal nostro test di similarità sia da una giuria di tre LLM. Le dichiarazioni esplicite mancanti non ricevono alcun punteggio. Qwen3.8-max ha risposto…

Sicurezza informatica
Benchmark
22 set

Benchmark del software di backup: Acronis vs NinjaOne vs Comet vs MSP360

Abbiamo confrontato NinjaOne Backup, Acronis Cyber Protect Cloud Backup, Comet Backup e MSP360 Managed Backup su un'infrastruttura AWS identica. Ogni fornitore ha eseguito un backup in modalità file dello stesso carico di lavoro da 625.946 file / 50 GB e un backup completo dell'immagine del disco di sistema, quindi ha ripristinato la sottodirectory media da…

IA
Benchmark
22 set

Text-to-SQL: Confronto dell'accuratezza degli LLM

Abbiamo eseguito 36 grandi modelli linguistici su 759 domande di BIRD-SQL, ciascun modello scrivendo SQL contro un database che doveva identificare da solo tra 11 candidati. Ogni query analizzabile è stata eseguita sul database reale e il suo set di risultati confrontato con il set di risultati della query gold di BIRD. Le query mancanti,…

IA
Confronto delle Funzionalità
22 set

Indice dei prezzi di noleggio delle GPU cloud

Monitoriamo i prezzi di noleggio di GPU cloud pubblicati per 17 modelli presso 75 provider, coprendo tariffe on-demand, spot e riservate. Il gruppo Ultime rilasciate presenta il maggiore aumento di prezzo tra i tre gruppi. La sua mediana on-demand è passata da $2,12 per GPU-ora nell'ottobre 2024 a $4,72 nel settembre 2026. Nello stesso periodo,…

IA
Benchmark
22 set

Reranker benchmark: confronto tra i migliori 8 modelli

Abbiamo testato 8 modelli di reranking su ~145k recensioni Amazon in inglese per misurare quanto una fase di reranking migliori il recupero denso. Abbiamo recuperato i primi 100 candidati con multilingual-e5-base, li abbiamo riordinati con ciascun modello e abbiamo valutato i primi 10 risultati rispetto a 300 query, ognuna delle quali fa riferimento a dettagli…

IA
Confronto delle Funzionalità
21 set

I migliori 30+ produttori di chip IA: NVIDIA e i suoi concorrenti

Sulla base della nostra esperienza nell'esecuzione del benchmark cloud GPU di AIMultiple, confrontiamo i produttori di chip per prodotto, disponibilità e architettura, coprendo GPU per data center, chip mobili, acceleratori edge e fonderie. Ogni riga indica un prodotto rappresentativo, il suo tipo e la sua disponibilità. La disponibilità distingue l'hardware offerto in vendita, i servizi…

Sicurezza informatica
Benchmark
21 set

Rilevamento bot: 9 fornitori anti-bot messi a confronto

Abbiamo eseguito due benchmark su siti web live, quindi abbiamo identificato l'azienda anti-bot davanti a ogni dominio e misurato quanto spesso i domini di ciascuna azienda restituivano il contenuto richiesto. Questo copre oltre 3.800 domini etichettati e oltre 50.000 richieste. Il primo benchmark ha prelevato pagine prodotto e di ricerca su 100 domini e-commerce, 50…

Dati
Benchmark
21 set

Browser remoti: infrastruttura web per agenti IA a confronto

Gli agenti IA si affidano ai browser remoti per automatizzare le attività web senza essere bloccati da misure anti-scraping. Le prestazioni di questa infrastruttura browser sono fondamentali per il successo di un agente. Abbiamo confrontato 8 fornitori in base a tasso di successo, velocità e funzionalità. Per farlo, abbiamo eseguito 160 attività automatizzate, eseguendo 4…

Dati
Benchmark
21 set

Web Scraping su Larga Scala: 7 Fornitori Confrontati

Abbiamo eseguito due benchmark su siti web live, da 5 a 5.000 richieste concorrenti. Il primo ha inviato 260.000 richieste attraverso quattro web unblocker sui primi 10.000 domini Tranco, più un test di estrazione markdown su 10.000 URL. Il secondo ha recuperato 65.000 pagine prodotto e di ricerca da ciascuno dei cinque fornitori di scraping…

Dati
Benchmark
21 set

Scraper per e-commerce: 4 fornitori a confronto

Abbiamo confrontato quattro fornitori di dati web su 100 domini e-commerce, recuperando 65.000 pagine prodotto e di ricerca con livelli da 5 a 5.000 richieste concorrenti. In media tra i livelli di concorrenza, Bright Data ha raggiunto il tasso di successo più alto (76%) con un tempo mediano di 16 secondi. Apify ha registrato il…