Premium
Servizi
Premium
Ekrem Sarı

Ekrem Sarı

Ricercatore IA
37 Articoli
Rimani aggiornato sulle novità tecnologiche B2B.

Ekrem è un Ricercatore IA e Data Scientist presso AIMultiple. Progetta ed esegue benchmark pratici per sistemi di IA e LLM.

Esperienza professionale

Presso AIMultiple, Ekrem esegue benchmark su sistemi di IA end-to-end e realizza i flussi di lavoro dei dati e le dashboard utilizzate per monitorare le metriche di benchmark e di prodotto. I suoi benchmark coprono modelli di embedding e reranker, database vettoriali e a grafo, motori di inference, quantizzazione, concorrenza GPU e scaling multi-GPU, prezzi e provider di GPU cloud, text-to-SQL e framework RAG e RAG agentici.

Prima di AIMultiple, ha lavorato come Data Scientist presso Yandex, dove ha interrogato e analizzato grandi dataset con SQL per valutare la qualità di ricerca e ranking rispetto a linee guida dettagliate.

Interessi di ricerca

Il lavoro di Ekrem si concentra sulla misurazione delle prestazioni pratiche dei sistemi LLM e di retrieval. Progetta il test harness, esegue i carichi di lavoro su hardware reale e confronta modelli, framework e infrastrutture in termini di accuratezza, throughput, latenza, costo e scalabilità, lungo l'intero stack dai modelli di embedding e database vettoriali ai motori di inference e all'infrastruttura GPU. La sua tesi di laurea magistrale automatizza le revisioni sistematiche della letteratura con una pipeline basata su RAG.

Formazione

Ekrem ha conseguito una laurea magistrale in Sistemi Informativi Gestionali presso la Başkent University, dove la sua tesi ha automatizzato le revisioni sistematiche della letteratura con una pipeline basata su RAG, e sta conseguendo una seconda laurea magistrale in Ingegneria dei Dati e della Conoscenza presso la Hacettepe University.

Ultimi articoli di Ekrem

Dati
Benchmark
21 set

Scraper per e-commerce: 4 fornitori a confronto

Abbiamo confrontato quattro fornitori di dati web su 100 domini e-commerce, recuperando 65.000 pagine prodotto e di ricerca con livelli da 5 a 5.000 richieste concorrenti. In media tra i livelli di concorrenza, Bright Data ha raggiunto il tasso di successo più alto (76%) con un tempo mediano di 16 secondi. Apify ha registrato il…

IA
Valutazione in Mondo Aperto
21 set

I 70+ migliori provider cloud GPU

I provider di cloud GPU si dividono in tre livelli. Gli hyperscaler gestiscono piattaforme cloud ampie con il noleggio di GPU come uno dei tanti prodotti. I neocloud specializzati si concentrano sulle infrastrutture GPU e IA come prodotto principale. I marketplace comunitari aggregano l'inventario di molti piccoli operatori, spesso al livello più basso della forbice…

Sicurezza informatica
Benchmark
21 set

Benchmark del software DLP

Abbiamo confrontato Acronis DeviceLock DLP e ManageEngine DLP Plus su macchine virtuali Windows Server 2022 identiche con 28 scenari: 23 test di fuga di dati (inclusi 12 file di elusione avversariale), 3 test di sicurezza dell'agente e 2 test sotto elevato consumo di CPU e memoria. Per gli altri prodotti DLP, Netwrix Endpoint Protector, Sophos…

IA
Approfondimento
21 set

LLM Calcolatore VRAM per il self-hosting

Il self-hosting di un LLM significa eseguire l'inferenza su hardware controllato dall'operatore anziché tramite un'API di terze parti, il che cambia il profilo di costi, controllo dei dati e privacy. Il fatto che un modello possa girare dipende interamente dalla memoria. Il calcolatore stima la VRAM o la memoria unificata necessaria a un modello per…

IA
Benchmark
21 set

Benchmark multi-GPU: B200 vs H200 vs H100 vs MI300X

Per oltre due decenni, l'ottimizzazione delle prestazioni di calcolo è stata una pietra angolare del mio lavoro. Abbiamo confrontato le GPU NVIDIA B200, H200, H100 e la AMD MI300X per valutare quanto scalano bene per l'inference di Large Language Model (LLM). Utilizzando il framework vLLM con il model meta-llama/Llama-3.1-8B-Instruct, abbiamo eseguito i test su 1,…

IA
Benchmark
21 set

GPU Benchmark di concorrenza: H100 vs H200 vs B200 vs MI300X

Ho trascorso gli ultimi 20 anni concentrandomi sull'ottimizzazione delle prestazioni computazionali a livello di sistema. Abbiamo sottoposto a benchmark le più recenti NVIDIA GPU, tra cui la NVIDIA H100, H200 e B200, e la AMD MI300X, per l'analisi della scalabilità della concorrenza. Utilizzando il framework vLLM con il gpt-oss-20b model, abbiamo testato come queste GPU…

Dati
Benchmark
18 set

Benchmark dell'API di ricerca video: Bright Data vs YouTube

Abbiamo confrontato la ricerca video di Bright Data con la ricerca di YouTube su 50 query in inglese di cinque tipi. Entrambi i motori sono stati interrogati fino all'esaurimento e un panel a tre model ha valutato i fotogrammi video campionati. La stima dei clip utilizzabili per ricerca indica quanti video restituiti contengono il soggetto…

IA
Benchmark
17 set

Alternative a DGX Spark: RTX, Ryzen IA Halo e Mac Studio

Confrontiamo i benchmark di inferenza pubblicati di DGX Spark, RTX e Ryzen IA Halo, coprendo l'elaborazione dei prompt, la generazione di token e i contesti più lunghi. Le alternative includono Framework Desktop, Mac Studio e i sistemi GB10 di altri produttori. La velocità di decodifica misura i token in output generati al secondo. Valori più…

IA
Valutazione in Mondo Aperto
16 set

GPU cloud gratuite: modelli, limiti e requisiti di accesso

Le GPU cloud gratuite sono disponibili tramite notebook Python, demo IA e crediti di calcolo mensili. Confronta l'hardware GPU, le quote gratuito e i requisiti di accesso, oppure verifica quali servizi si adattano al tuo carico di lavoro. Due T4 forniscono due allocazioni separate di memoria da 16 GB. Eseguire un modello su entrambe richiede…

IA
Benchmark
15 set

Confronto dei modelli fondazionali relazionali

Abbiamo confrontato SAP-RPT-1-OSS con il gradient boosting (LightGBM, CatBoost) su 17 dataset tabulari che coprono lo spettro semantico-numerico, tabelle piccole/ad alta semantica, dataset aziendali misti e grandi dataset numerici a bassa semantica. Il nostro obiettivo è misurare dove i priori semantici pre-addestrati di un LLM relazionale possano offrire vantaggi rispetto ai modelli ad albero tradizionali…