Premium
Services
Premium
Ekrem Sarı

Ekrem Sarı

Chercheur en IA
37 Articles
Restez informé des dernières technologies B2B

Ekrem est chercheur en IA et scientifique des données chez AIMultiple. Il conçoit et exécute des benchmarks pratiques pour les systèmes d'IA et de LLM.

Expérience professionnelle

Chez AIMultiple, Ekrem évalue des systèmes d'IA de bout en bout et construit les flux de données et les tableaux de bord utilisés pour suivre les indicateurs de benchmark et de produit. Ses benchmarks couvrent les modèles d'embedding et de reclassement, les bases de données vectorielles et de graphes, les moteurs d'inférence, la quantification, la concurrence GPU et la mise à l'échelle multi-GPU, la tarification et les fournisseurs de GPU cloud, le text-to-SQL, ainsi que les frameworks RAG et RAG agentique.

Avant AIMultiple, il a travaillé comme scientifique des données chez Yandex, où il a interrogé et analysé de grands datasets avec SQL pour évaluer la qualité de la recherche et du classement par rapport à des consignes détaillées.

Intérêts de recherche

Les travaux d'Ekrem portent sur la mesure des performances en conditions réelles des systèmes LLM et de recherche d'information. Il conçoit le harnais de test, exécute les charges de travail sur du matériel réel et compare les modèles, les frameworks et l'infrastructure en termes de précision, de débit, de latence, de coût et d'évolutivité, sur l'ensemble de la pile, des modèles d'embedding et des bases de données vectorielles aux moteurs d'inférence et à l'infrastructure GPU. Son mémoire de master automatise les revues systématiques de la littérature avec un pipeline basé sur RAG.

Formation

Ekrem est titulaire d'un master en systèmes d'information de gestion de l'université Başkent, où son mémoire a automatisé les revues systématiques de la littérature avec un pipeline basé sur RAG, et poursuit un deuxième master en ingénierie des données et de la connaissance à l'université Hacettepe.

Derniers articles de Ekrem

Données
Benchmark
21 sep

Navigateurs distants: infrastructure web pour agents IA comparée

Les agents IA s'appuient sur des navigateurs distants pour automatiser des tâches web sans être bloqués par les mesures anti-scraping. La performance de cette infrastructure de navigateur est essentielle à la réussite d'un agent. Nous avons évalué 8 fournisseurs sur le taux de réussite, la vitesse et les fonctionnalités. Pour ce faire, nous avons exécuté…

Données
Benchmark
21 sep

Web Scraping à Grande Échelle: 7 Fournisseurs Évalués

Nous avons exécuté deux benchmarks sur des sites web réels, de 5 à 5 000 requêtes simultanées. Le premier a envoyé 260 000 requêtes via quatre débloqueurs web sur les 10 000 premiers domaines Tranco, plus un test d'extraction markdown sur 10 000 URLs. Le second a récupéré 65 000 pages produits et pages de recherche auprès de chacun des…

Données
Benchmark
21 sep

Scraper e-commerce: 4 fournisseurs évalués

Nous avons comparé quatre fournisseurs de données web sur 100 domaines e-commerce, en récupérant 65 000 pages produit et recherche chacun, avec un niveau de 5 à 5 000 requêtes simultanées. En moyenne sur les niveaux de simultanéité, Bright Data a atteint le taux de réussite le plus élevé (76 %) avec une médiane de 16…

IA
Évaluation en Monde Ouvert
21 sep

Top 70+ fournisseurs de GPU cloud

Les fournisseurs de GPU cloud se répartissent en trois catégories. Les hyperscalers exploitent de vastes plateformes cloud où la location de GPU n'est qu'un produit parmi beaucoup d'autres. Les neoclouds spécialisés se concentrent sur l'infrastructure GPU et IA comme produit principal. Les places de marché communautaires regroupent l'inventaire de nombreux petits opérateurs, souvent au plancher…

Cybersécurité
Benchmark
21 sep

Benchmark des logiciels DLP

Nous avons évalué Acronis DeviceLock DLP et ManageEngine DLP Plus sur des machines virtuelles Windows Server 2022 identiques avec 28 scénarios : 23 tests de fuite de données (dont 12 fichiers d'évasion adversaire), 3 tests de sécurité de l'agent et 2 tests sous forte consommation de CPU et de mémoire. Pour les autres produits DLP,…

IA
Analyse
21 sep

LLM Calculateur de VRAM pour l'auto-hébergement

Auto-héberger un LLM signifie exécuter l'inférence sur du matériel contrôlé par l'opérateur plutôt que via une API tierce, ce qui modifie le coût, le contrôle des données et le profil de confidentialité. Qu'un modèle puisse s'exécuter dépend de la mémoire. Le calculateur estime la VRAM ou la mémoire unifiée dont un modèle a besoin pour…

IA
Benchmark
21 sep

Benchmark multi-GPU: B200 vs H200 vs H100 vs MI300X

Depuis plus de deux décennies, l’optimisation des performances de calcul est une pierre angulaire de mon travail. Nous avons évalué les GPU NVIDIA B200, H200, H100 et le MI300X d’AMD afin d’évaluer leur capacité de mise à l’échelle pour l’inférence de grands modèles de langage (LLM). En utilisant le framework vLLM avec le modèle meta-llama/Llama-3.1-8B-Instruct,…

IA
Benchmark
21 sep

GPU Benchmark de concurrence: H100 vs H200 vs B200 vs MI300X

J'ai passé les 20 dernières années à me concentrer sur l'optimisation des performances de calcul au niveau système. Nous avons évalué les derniers NVIDIA GPUs, y compris les NVIDIA H100, H200 et B200, et l'AMD MI300X, pour une analyse de mise à l'échelle de la concurrence. En utilisant le framework vLLM avec le gpt-oss-20b model,…

Données
Benchmark
18 sep

Benchmark de recherche vidéo API: Bright Data vs YouTube

Nous avons comparé la recherche vidéo Bright Data avec la recherche YouTube sur 50 requêtes en anglais réparties en cinq types de requêtes. Les deux moteurs ont été interrogés jusqu’à épuisement, et un panel de trois modèles a évalué des images vidéo échantillonnées. Les clips exploitables par recherche estiment combien de vidéos renvoyées contiennent le…

IA
Benchmark
17 sep

Alternatives au DGX Spark: RTX, Ryzen IA Halo et Mac Studio

Nous comparons les benchmarks d’inference publiés pour DGX Spark, RTX et Ryzen IA Halo, couvrant le traitement des prompts, la génération de tokens et les contextes plus longs. Les alternatives incluent le Framework Desktop, le Mac Studio et les systèmes GB10 d’autres fabricants. La vitesse de décodage mesure les tokens de sortie générés par seconde.…