Ekrem Sarı
Ekrem è un ricercatore di intelligenza artificiale presso AIMultiple, specializzato in automazione intelligente, GPU, agenti di IA e LLMOps per framework RAG.
Esperienza professionale
Durante il suo incarico come valutatore presso Yandex, ha analizzato i risultati di ricerca utilizzando framework proprietari e protocolli automatizzati. Ha implementato test di controllo qualità tramite annotazione dei dati, punteggio di pertinenza e mappatura dell'intento dell'utente su oltre 10.000 query al mese, conducendo al contempo valutazioni tecniche, tra cui il monitoraggio delle prestazioni e il rilevamento dello spam tramite cicli di feedback basati sull'apprendimento automatico.Capacità di ricerca
Presso AIMultiple, la sua ricerca si concentra sul ciclo di vita MLOps e sulle prestazioni e il benchmarking di sistemi di intelligenza artificiale end-to-end. Contribuisce a una vasta gamma di progetti, tra cui l'ottimizzazione del Retrieval-Augmented Generation (RAG), un ampio benchmarking di Large Language Model (LLM) e la progettazione di framework di intelligenza artificiale agentica. Ekrem è specializzato nello sviluppo di metodologie basate sui dati per misurare e migliorare le prestazioni della tecnologia IA in base a metriche operative critiche come accuratezza, efficienza, costo delle API e scalabilità. La sua analisi copre l'intero stack tecnologico, dai componenti fondamentali come i modelli di embedding e i database vettoriali fino alle GPU ad alte prestazioni e all'infrastruttura cloud necessarie per implementare agenti IA.Preparazione
Ekrem ha conseguito una laurea presso la Hacettepe Üniversitesi e un master presso la Başkent Üniversitesi.Ultimi articoli di Ekrem
I migliori oltre 60 fornitori di cloud GPU
I fornitori di cloud GPU si dividono in tre livelli. Gli hyperscaler gestiscono ampie piattaforme cloud con il noleggio di GPU come uno dei tanti prodotti. Le neocloud specializzate si concentrano su GPU e infrastrutture IA come prodotto principale. I marketplace comunitari aggregano l'inventario da molti piccoli operatori, spesso al prezzo minimo della fascia pubblicata.…
Confronto dei 6 migliori servizi cloud GPU gratuiti
Il miglior tier free GPU vale circa $19 al mese ai prezzi di noleggio, e otto piattaforme offrono una GPU reale senza carta di credito. Sei di esse limitano l'uso free su base mensile, e le abbiamo valutate al tasso on-demand più economico attuale per ogni GPU nei nostri dati di cloud GPU prezzi. Ogni…
Benchmark dei software di backup: Acronis vs NinjaOne vs Comet vs MSP360
Abbiamo confrontato NinjaOne Backup, Acronis Cyber Protect Cloud Backup, Comet Backup e MSP360 Managed Backup su un'infrastruttura AWS identica. Ogni fornitore ha eseguito un backup in modalità file dello stesso carico di lavoro di 625,946 file / 50 GB e un backup completo dell'immagine del disco di sistema, per poi ripristinare la sottodirectory media da…
Calcolatore per il dimensionamento e la scelta di database vettoriali
La domanda pratica dietro un database vettoriale self-hosted per RAG è quale motore si adatta a un dato server, e quale il carico di lavoro esclude. Il calcolatore qui sotto risponde a entrambe, dal nostro benchmark di sette database vettoriali self-hosted eseguiti con recall abbinata su embedding identici. Cinque caselle di controllo nella parte superiore…
Benchmark di Disaster Recovery: Acronis vs Comet vs MSP360
Abbiamo confrontato Acronis Cyber Protect Cloud, Comet Backup e MSP360 Managed Backup sul disaster recovery. Ogni fornitore ha creato un'immagine di un Windows Server 2022 in esecuzione e di un server Ubuntu 24.04 in esecuzione con lo stesso carico di lavoro deterministico, un servizio web, un database da 10.000 righe e 50 file, per poi…
Scraper per e-commerce: 6 provider confrontati
Abbiamo confrontato cinque provider di dati web su 100 domini e-commerce, recuperando 65.000 pagine di prodotto e di ricerca ciascuno con da 5 a 5.000 richieste simultanee. In media tra i livelli di concorrenza, Decodo ha registrato il tempo di risposta mediano più veloce, circa 7 secondi, con un tasso di successo del 59%, mentre…
Migliori strumenti, framework e librerie RAG
RAG migliora le risposte degli LLM ancorandole a dati esterni anziché basarsi solo su ciò che il modello ha memorizzato durante l'addestramento. Abbiamo confrontato i componenti di cui è composto un sistema RAG e raccolto i risultati in un unico posto, con una guida pratica per scegliere ogni parte dello stack. Consulta i nostri risultati…
Benchmark di Database Vettoriali: 7 Motori Open-Source per RAG
Abbiamo sottoposto a benchmark sette database vettoriali open-source e self-hosted come livello di recupero di una pipeline RAG, ciascuno eseguito singolarmente sugli stessi embedding bge-m3 e su query mediche e tecniche reali, in modo che l'indice del database fosse l'unica variabile. Il carico di lavoro ha coperto MedRAG-50k, TechQA-28k e un corpus di 2.25M di…
GPU Benchmark di concorrenza: H100 vs H200 vs B200 vs MI300X
Ho trascorso gli ultimi 20 anni concentrandomi sull'ottimizzazione delle prestazioni computazionali a livello di sistema. Abbiamo testato le più recenti NVIDIA GPU, incluse le NVIDIA H100, H200 e B200 e la AMD MI300X, per l'analisi del ridimensionamento della concorrenza. Utilizzando il framework vLLM con il gpt-oss-20b modello, abbiamo verificato come queste GPU gestiscono le richieste…
Text-to-SQL: Confronto dell'accuratezza dei LLM
Ho fatto affidamento su SQL per l'analisi dei dati per 18 anni, a partire dai miei giorni come consulente. Tradurre domande in linguaggio naturale in SQL rende i dati più accessibili, consentendo a chiunque, anche a chi non ha competenze tecniche, di lavorare direttamente con i database. Abbiamo utilizzato la nostra text-to-SQL metodologia di benchmark…
Newsletter AI Multiple
Una email gratuita a settimana con le ultime notizie tecnologiche B2B e approfondimenti di esperti per dare impulso alla tua azienda.