Ekrem Sarı
Ekrem est chercheur en IA chez AIMultiple, spécialisé dans l'automatisation intelligente, les GPU, les agents IA et le LLMOps pour les frameworks RAG.
Expérience professionnelle
Durant son poste d'évaluateur chez Yandex, il a analysé les résultats de recherche à l'aide de frameworks propriétaires et de protocoles automatisés. Il a mis en œuvre des tests d'assurance qualité par l'annotation de données, l'attribution de scores de pertinence et la cartographie de l'intention de l'utilisateur sur plus de 10 000 requêtes mensuelles, tout en réalisant des évaluations techniques, notamment le suivi des performances et la détection de spam grâce à des boucles de rétroaction d'apprentissage automatique.Intérêts de recherche
Chez AIMultiple, ses recherches portent sur le cycle de vie MLOps et l'évaluation des performances des systèmes d'IA de bout en bout. Il contribue à de nombreux projets, notamment l'optimisation de la génération augmentée par la recherche (RAG), l'évaluation comparative de modèles de langage étendus (LLM) et la conception de frameworks d'IA agentiques. Ekrem est spécialisé dans le développement de méthodologies basées sur les données pour mesurer et améliorer les performances des technologies d'IA selon des indicateurs opérationnels critiques tels que la précision, l'efficacité, le coût des API et la scalabilité. Son analyse couvre l'ensemble de la pile technologique, des composants fondamentaux comme les modèles embarqués et les bases de données vectorielles jusqu'à l'infrastructure GPU et cloud haute performance nécessaire au déploiement des agents d'IA.Éducation
Ekrem est titulaire d'un baccalauréat de l'université Hacettepe et d'une maîtrise de l'université Başkent.Derniers articles de Ekrem
Top 60+ fournisseurs Cloud GPU
Les fournisseurs de GPU cloud se répartissent en trois niveaux. Les hyperscalers exploitent de larges plateformes cloud où la location de GPU n’est qu’un produit parmi d’autres. Les néoclouds spécialisés se concentrent sur l’infrastructure GPU et IA comme produit principal. Les places de marché communautaires agrègent l’inventaire de nombreux petits opérateurs, souvent au plus bas…
Comparaison des 6 meilleurs services GPU cloud gratuits
Le meilleur niveau free de GPU vaut environ 19 $ par mois aux tarifs de location, et huit plateformes offrent un véritable GPU sans carte de crédit. Six d'entre elles plafonnent l'utilisation free par mois, et nous les avons chiffrées au tarif à la demande le moins cher actuel pour chaque GPU dans nos données…
Benchmark des logiciels de sauvegarde: Acronis vs NinjaOne vs Comet vs MSP360
Nous avons comparé NinjaOne Backup, Acronis Cyber Protect Cloud Backup, Comet Backup et MSP360 Managed Backup sur une infrastructure AWS identique. Chaque fournisseur a exécuté une sauvegarde en mode fichier de la même charge de travail de 625,946 fichiers / 50 Go et une sauvegarde complète de l'image du disque système, puis a restauré le…
Calculateur de dimensionnement et de sélection de bases de données vectorielles
La question pratique derrière une base de données vectorielle auto-hébergée pour RAG est de savoir quel moteur convient à un serveur donné, et lequel est exclu par la charge de travail. Le calculateur ci-dessous répond aux deux, à partir de notre benchmark de sept bases de données vectorielles auto-hébergées exécuté à rappel équivalent sur des…
Comparatif de reprise après sinistre: Acronis vs Comet vs MSP360
Nous avons comparé Acronis Cyber Protect Cloud, Comet Backup et MSP360 Managed Backup en matière de reprise après sinistre. Chaque fournisseur a imagé un serveur Windows Server 2022 en production et un serveur Ubuntu 24.04 en production exécutant la même charge de travail déterministe, un service web, une base de données de 10 000 lignes…
Scraper e-commerce: 6 fournisseurs benchmarkés
Nous avons benchmarké cinq fournisseurs de données web sur 100 domaines e-commerce, en récupérant 65 000 pages produit et recherche chacun, avec un niveau de concurrence de 5 à 5 000 requêtes simultanées. En moyenne sur les différents niveaux de concurrence, Decodo a enregistré le temps de réponse médian le plus rapide, environ 7 secondes,…
Meilleurs outils, frameworks et bibliothèques RAG
RAG améliore les réponses des LLM en les fondant sur des données externes au lieu de ce que le modèle a mémorisé lors de l'entraînement. Nous avons évalué les composants d'un système RAG et rassemblé les résultats en un seul endroit, avec un guide pratique pour choisir chaque partie de la pile. Voir nos résultats…
Benchmark de bases de données vectorielles: 7 moteurs open-source pour RAG
Nous avons benchmarké sept bases de données vectorielles open-source auto-hébergées en tant que couche de récupération d'un pipeline RAG, chacune exécutée une à la fois sur des embeddings bge-m3 identiques et des requêtes médicales et techniques réelles, de sorte que l'index de la base de données était la seule variable. La charge de travail couvrait…
GPU Benchmark de concurrence: H100 vs H200 vs B200 vs MI300X
J'ai passé les dernières 20 années à me concentrer sur l'optimisation des performances de calcul au niveau du système. Nous avons évalué les derniers GPU NVIDIA, y compris les NVIDIA H100, H200 et B200, et le AMD MI300X, pour une analyse de la mise à l'échelle de la concurrence. En utilisant le framework vLLM avec…
De texte à SQL: Comparaison de la précision des LLM
J'utilise SQL pour l'analyse de données depuis 18 ans, depuis mes débuts en tant que consultant. Traduire des questions en langage naturel en SQL rend les données plus accessibles, permettant à quiconque, même sans compétences techniques, de travailler directement avec les bases de données. Nous avons utilisé notre méthodologie de benchmark de texte vers SQL…
Newsletter AIMultiple
Un e-mail gratuit par semaine contenant les dernières actualités technologiques B2B et des analyses d'experts pour accélérer la croissance de votre entreprise.