Services
Contactez-nous
Ekrem Sarı

Ekrem Sarı

Chercheur en IA
32 Articles
Restez informé des dernières technologies B2B

Ekrem est chercheur en IA chez AIMultiple, spécialisé dans l'automatisation intelligente, les GPU, les agents IA et le LLMOps pour les frameworks RAG.

Expérience professionnelle

Durant son poste d'évaluateur chez Yandex, il a analysé les résultats de recherche à l'aide de frameworks propriétaires et de protocoles automatisés. Il a mis en œuvre des tests d'assurance qualité par l'annotation de données, l'attribution de scores de pertinence et la cartographie de l'intention de l'utilisateur sur plus de 10 000 requêtes mensuelles, tout en réalisant des évaluations techniques, notamment le suivi des performances et la détection de spam grâce à des boucles de rétroaction d'apprentissage automatique.

Intérêts de recherche

Chez AIMultiple, ses recherches portent sur le cycle de vie MLOps et l'évaluation des performances des systèmes d'IA de bout en bout. Il contribue à de nombreux projets, notamment l'optimisation de la génération augmentée par la recherche (RAG), l'évaluation comparative de modèles de langage étendus (LLM) et la conception de frameworks d'IA agentiques. Ekrem est spécialisé dans le développement de méthodologies basées sur les données pour mesurer et améliorer les performances des technologies d'IA selon des indicateurs opérationnels critiques tels que la précision, l'efficacité, le coût des API et la scalabilité. Son analyse couvre l'ensemble de la pile technologique, des composants fondamentaux comme les modèles embarqués et les bases de données vectorielles jusqu'à l'infrastructure GPU et cloud haute performance nécessaire au déploiement des agents d'IA.

Éducation

Ekrem est titulaire d'un baccalauréat de l'université Hacettepe et d'une maîtrise de l'université Başkent.

Derniers articles de Ekrem

IA
Évaluation en Monde Ouvert
23 Juil

Top 60+ fournisseurs Cloud GPU

Les fournisseurs de GPU cloud se répartissent en trois niveaux. Les hyperscalers exploitent de larges plateformes cloud où la location de GPU n’est qu’un produit parmi d’autres. Les néoclouds spécialisés se concentrent sur l’infrastructure GPU et IA comme produit principal. Les places de marché communautaires agrègent l’inventaire de nombreux petits opérateurs, souvent au plus bas…

IA
Évaluation en Monde Ouvert
23 Juil

Comparaison des 6 meilleurs services GPU cloud gratuits

Le meilleur niveau free de GPU vaut environ 19 $ par mois aux tarifs de location, et huit plateformes offrent un véritable GPU sans carte de crédit. Six d'entre elles plafonnent l'utilisation free par mois, et nous les avons chiffrées au tarif à la demande le moins cher actuel pour chaque GPU dans nos données…

Cybersécurité
Benchmark
21 Juil

Benchmark des logiciels de sauvegarde: Acronis vs NinjaOne vs Comet vs MSP360

Nous avons comparé NinjaOne Backup, Acronis Cyber Protect Cloud Backup, Comet Backup et MSP360 Managed Backup sur une infrastructure AWS identique. Chaque fournisseur a exécuté une sauvegarde en mode fichier de la même charge de travail de 625,946 fichiers / 50 Go et une sauvegarde complète de l'image du disque système, puis a restauré le…

IA
Benchmark
20 Juil

Calculateur de dimensionnement et de sélection de bases de données vectorielles

La question pratique derrière une base de données vectorielle auto-hébergée pour RAG est de savoir quel moteur convient à un serveur donné, et lequel est exclu par la charge de travail. Le calculateur ci-dessous répond aux deux, à partir de notre benchmark de sept bases de données vectorielles auto-hébergées exécuté à rappel équivalent sur des…

Cybersécurité
Évaluation en Monde Ouvert
20 Juil

Comparatif de reprise après sinistre: Acronis vs Comet vs MSP360

Nous avons comparé Acronis Cyber Protect Cloud, Comet Backup et MSP360 Managed Backup en matière de reprise après sinistre. Chaque fournisseur a imagé un serveur Windows Server 2022 en production et un serveur Ubuntu 24.04 en production exécutant la même charge de travail déterministe, un service web, une base de données de 10 000 lignes…

Données
Benchmark
19 Juil

Scraper e-commerce: 6 fournisseurs benchmarkés

Nous avons benchmarké cinq fournisseurs de données web sur 100 domaines e-commerce, en récupérant 65 000 pages produit et recherche chacun, avec un niveau de concurrence de 5 à 5 000 requêtes simultanées. En moyenne sur les différents niveaux de concurrence, Decodo a enregistré le temps de réponse médian le plus rapide, environ 7 secondes,…

IA
Benchmark
18 Juil

Meilleurs outils, frameworks et bibliothèques RAG

RAG améliore les réponses des LLM en les fondant sur des données externes au lieu de ce que le modèle a mémorisé lors de l'entraînement. Nous avons évalué les composants d'un système RAG et rassemblé les résultats en un seul endroit, avec un guide pratique pour choisir chaque partie de la pile. Voir nos résultats…

IA
Benchmark
18 Juil

Benchmark de bases de données vectorielles: 7 moteurs open-source pour RAG

Nous avons benchmarké sept bases de données vectorielles open-source auto-hébergées en tant que couche de récupération d'un pipeline RAG, chacune exécutée une à la fois sur des embeddings bge-m3 identiques et des requêtes médicales et techniques réelles, de sorte que l'index de la base de données était la seule variable. La charge de travail couvrait…

IA
Benchmark
18 Juil

GPU Benchmark de concurrence: H100 vs H200 vs B200 vs MI300X

J'ai passé les dernières 20 années à me concentrer sur l'optimisation des performances de calcul au niveau du système. Nous avons évalué les derniers GPU NVIDIA, y compris les NVIDIA H100, H200 et B200, et le AMD MI300X, pour une analyse de la mise à l'échelle de la concurrence. En utilisant le framework vLLM avec…

IA
Benchmark
17 Juil

De texte à SQL: Comparaison de la précision des LLM

J'utilise SQL pour l'analyse de données depuis 18 ans, depuis mes débuts en tant que consultant. Traduire des questions en langage naturel en SQL rend les données plus accessibles, permettant à quiconque, même sans compétences techniques, de travailler directement avec les bases de données. Nous avons utilisé notre méthodologie de benchmark de texte vers SQL…