Servizi
Contattaci
Ekrem Sarı

Ekrem Sarı

Ricercatore di intelligenza artificiale
32 Articoli
Rimani aggiornato sulle novità tecnologiche B2B.

Ekrem è un ricercatore di intelligenza artificiale presso AIMultiple, specializzato in automazione intelligente, GPU, agenti di IA e LLMOps per framework RAG.

Esperienza professionale

Durante il suo incarico come valutatore presso Yandex, ha analizzato i risultati di ricerca utilizzando framework proprietari e protocolli automatizzati. Ha implementato test di controllo qualità tramite annotazione dei dati, punteggio di pertinenza e mappatura dell'intento dell'utente su oltre 10.000 query al mese, conducendo al contempo valutazioni tecniche, tra cui il monitoraggio delle prestazioni e il rilevamento dello spam tramite cicli di feedback basati sull'apprendimento automatico.

Capacità di ricerca

Presso AIMultiple, la sua ricerca si concentra sul ciclo di vita MLOps e sulle prestazioni e il benchmarking di sistemi di intelligenza artificiale end-to-end. Contribuisce a una vasta gamma di progetti, tra cui l'ottimizzazione del Retrieval-Augmented Generation (RAG), un ampio benchmarking di Large Language Model (LLM) e la progettazione di framework di intelligenza artificiale agentica. Ekrem è specializzato nello sviluppo di metodologie basate sui dati per misurare e migliorare le prestazioni della tecnologia IA in base a metriche operative critiche come accuratezza, efficienza, costo delle API e scalabilità. La sua analisi copre l'intero stack tecnologico, dai componenti fondamentali come i modelli di embedding e i database vettoriali fino alle GPU ad alte prestazioni e all'infrastruttura cloud necessarie per implementare agenti IA.

Preparazione

Ekrem ha conseguito una laurea presso la Hacettepe Üniversitesi e un master presso la Başkent Üniversitesi.

Ultimi articoli di Ekrem

IA
Valutazione in Mondo Aperto
23 Lug

I migliori oltre 60 fornitori di cloud GPU

I fornitori di cloud GPU si dividono in tre livelli. Gli hyperscaler gestiscono ampie piattaforme cloud con il noleggio di GPU come uno dei tanti prodotti. Le neocloud specializzate si concentrano su GPU e infrastrutture IA come prodotto principale. I marketplace comunitari aggregano l'inventario da molti piccoli operatori, spesso al prezzo minimo della fascia pubblicata.…

IA
Valutazione in Mondo Aperto
23 Lug

Confronto dei 6 migliori servizi cloud GPU gratuiti

Il miglior tier free GPU vale circa $19 al mese ai prezzi di noleggio, e otto piattaforme offrono una GPU reale senza carta di credito. Sei di esse limitano l'uso free su base mensile, e le abbiamo valutate al tasso on-demand più economico attuale per ogni GPU nei nostri dati di cloud GPU prezzi. Ogni…

Sicurezza informatica
Benchmark
21 Lug

Benchmark dei software di backup: Acronis vs NinjaOne vs Comet vs MSP360

Abbiamo confrontato NinjaOne Backup, Acronis Cyber Protect Cloud Backup, Comet Backup e MSP360 Managed Backup su un'infrastruttura AWS identica. Ogni fornitore ha eseguito un backup in modalità file dello stesso carico di lavoro di 625,946 file / 50 GB e un backup completo dell'immagine del disco di sistema, per poi ripristinare la sottodirectory media da…

IA
Benchmark
20 Lug

Calcolatore per il dimensionamento e la scelta di database vettoriali

La domanda pratica dietro un database vettoriale self-hosted per RAG è quale motore si adatta a un dato server, e quale il carico di lavoro esclude. Il calcolatore qui sotto risponde a entrambe, dal nostro benchmark di sette database vettoriali self-hosted eseguiti con recall abbinata su embedding identici. Cinque caselle di controllo nella parte superiore…

Sicurezza informatica
Valutazione in Mondo Aperto
20 Lug

Benchmark di Disaster Recovery: Acronis vs Comet vs MSP360

Abbiamo confrontato Acronis Cyber Protect Cloud, Comet Backup e MSP360 Managed Backup sul disaster recovery. Ogni fornitore ha creato un'immagine di un Windows Server 2022 in esecuzione e di un server Ubuntu 24.04 in esecuzione con lo stesso carico di lavoro deterministico, un servizio web, un database da 10.000 righe e 50 file, per poi…

Dati
Benchmark
19 Lug

Scraper per e-commerce: 6 provider confrontati

Abbiamo confrontato cinque provider di dati web su 100 domini e-commerce, recuperando 65.000 pagine di prodotto e di ricerca ciascuno con da 5 a 5.000 richieste simultanee. In media tra i livelli di concorrenza, Decodo ha registrato il tempo di risposta mediano più veloce, circa 7 secondi, con un tasso di successo del 59%, mentre…

IA
Benchmark
18 Lug

Migliori strumenti, framework e librerie RAG

RAG migliora le risposte degli LLM ancorandole a dati esterni anziché basarsi solo su ciò che il modello ha memorizzato durante l'addestramento. Abbiamo confrontato i componenti di cui è composto un sistema RAG e raccolto i risultati in un unico posto, con una guida pratica per scegliere ogni parte dello stack. Consulta i nostri risultati…

IA
Benchmark
18 Lug

Benchmark di Database Vettoriali: 7 Motori Open-Source per RAG

Abbiamo sottoposto a benchmark sette database vettoriali open-source e self-hosted come livello di recupero di una pipeline RAG, ciascuno eseguito singolarmente sugli stessi embedding bge-m3 e su query mediche e tecniche reali, in modo che l'indice del database fosse l'unica variabile. Il carico di lavoro ha coperto MedRAG-50k, TechQA-28k e un corpus di 2.25M di…

IA
Benchmark
18 Lug

GPU Benchmark di concorrenza: H100 vs H200 vs B200 vs MI300X

Ho trascorso gli ultimi 20 anni concentrandomi sull'ottimizzazione delle prestazioni computazionali a livello di sistema. Abbiamo testato le più recenti NVIDIA GPU, incluse le NVIDIA H100, H200 e B200 e la AMD MI300X, per l'analisi del ridimensionamento della concorrenza. Utilizzando il framework vLLM con il gpt-oss-20b modello, abbiamo verificato come queste GPU gestiscono le richieste…

IA
Benchmark
17 Lug

Text-to-SQL: Confronto dell'accuratezza dei LLM

Ho fatto affidamento su SQL per l'analisi dei dati per 18 anni, a partire dai miei giorni come consulente. Tradurre domande in linguaggio naturale in SQL rende i dati più accessibili, consentendo a chiunque, anche a chi non ha competenze tecniche, di lavorare direttamente con i database. Abbiamo utilizzato la nostra text-to-SQL metodologia di benchmark…