Ekrem Sarı
Ekrem ist KI-Forscher bei AIMultiple und konzentriert sich auf intelligente Automatisierung, GPUs, KI-Agenten und LLMOps für RAG-Frameworks.
Berufserfahrung
Während seiner Tätigkeit als Assessor bei Yandex bewertete er Suchergebnisse mithilfe firmeneigener Frameworks und automatisierter Protokolle. Er implementierte Qualitätssicherungstests durch Datenannotation, Relevanzbewertung und Nutzerintention-Mapping für monatlich über 10.000 Suchanfragen und führte gleichzeitig technische Bewertungen durch, darunter Leistungsüberwachung und Spam-Erkennung mithilfe von ML-Feedbackschleifen.Forschungsinteresse
Bei AIMultiple konzentriert sich seine Forschung auf den MLOps-Lebenszyklus sowie die Leistungsfähigkeit und das Benchmarking von End-to-End-KI-Systemen. Er wirkt an einer Vielzahl von Projekten mit, darunter die Optimierung von Retrieval-Augmented Generation (RAG), umfassende Benchmarking-Studien für große Sprachmodelle (LLM) und die Entwicklung agentenbasierter KI-Frameworks. Ekrem ist spezialisiert auf die Entwicklung datengetriebener Methoden zur Messung und Verbesserung der Leistungsfähigkeit von KI-Technologien anhand kritischer Kennzahlen wie Genauigkeit, Effizienz, API-Kosten und Skalierbarkeit. Seine Analysen umfassen den gesamten Technologie-Stack, von grundlegenden Komponenten wie Einbettungsmodellen und Vektordatenbanken bis hin zur leistungsstarken GPU- und Cloud-Infrastruktur, die für den Einsatz von KI-Agenten erforderlich ist.Ausbildung
Ekrem hat einen Bachelor-Abschluss der Hacettepe Üniversitesi und einen Master-Abschluss der Başkent Üniversitesi.Neueste Artikel von Ekrem
Top 60+ Cloud GPU Anbieter
Cloud-GPU-Anbieter lassen sich in drei Stufen einteilen. Hyperscaler betreiben breite Cloud-Plattformen, bei denen die GPU-Vermietung nur eines von vielen Produkten ist. Spezialisierte Neoclouds konzentrieren sich auf GPU- und KI-Infrastruktur als ihr Kernprodukt. Community-Marktplätze bündeln das Inventar vieler kleiner Betreiber, oft zum unteren Ende der veröffentlichten Preisspanne. Wir verfolgen 71 Cloud-GPU-Anbieter und 14 kuratierte GPU-Modellfamilien mit…
Vergleich der Top 6 kostenlosen Cloud-GPU-Dienste
Die beste free GPU-Stufe ist etwa $19 pro Monat zu Mietpreisen wert, und acht Plattformen bieten eine echte GPU ohne Kreditkarte. Sechs davon begrenzen die free Nutzung pro Monat, und wir haben diese zum günstigsten aktuellen On-Demand-Tarif für jede GPU in unseren Cloud-GPU-Preisdaten bewertet. Jeder Balken stellt die Mietkosten derselben GPU-Zeit dar, berechnet als die…
Backup-Software-Benchmark: Acronis vs NinjaOne vs Comet vs MSP360
Wir haben NinjaOne Backup, Acronis Cyber Protect Cloud Backup, Comet Backup und MSP360 Managed Backup auf identischer AWS-Infrastruktur getestet. Jeder Anbieter führte eine dateibasierte Sicherung derselben Arbeitslast mit 625,946 Dateien / 50 GB und eine vollständige Image-Sicherung der Systemfestplatte durch und stellte dann das 15 GB große mittlere Unterverzeichnis wieder her. Hier sind die vier…
Vektordatenbank-Dimensionierungs- und Auswahlrechner
Die praktische Frage hinter einer selbst gehosteten Vektordatenbank für RAG ist, welche Engine auf einen bestimmten Server passt und welche die Arbeitslast ausschließt. Der folgende Rechner beantwortet beides, basierend auf unserem Benchmark von sieben selbst gehosteten Vektordatenbanken, die mit angeglichenem Recall auf identischen Embeddings getestet wurden. Fünf Kontrollkästchen oben im Rechner benennen fünf gängige RAG-Arbeitslasten,…
Disaster-Recovery-Benchmark: Acronis vs Comet vs MSP360
Wir haben Acronis Cyber Protect Cloud, Comet Backup und MSP360 Managed Backup im Bereich Disaster Recovery einem Benchmark unterzogen. Jeder Anbieter erstellte ein Image eines laufenden Windows Server 2022 und eines laufenden Ubuntu 24.04-Servers mit derselben deterministischen Arbeitslast, einem Webdienst, einer Datenbank mit 10.000 Zeilen und 50 Dateien und stellte dann die gesamte Maschine auf…
E-Commerce-Scraper: 6 Anbieter im Benchmark
Wir haben fünf Web-Datenanbieter über 100 E-Commerce-Domains hinweg einem Benchmark unterzogen und je 65.000 Produkt- und Suchseiten mit 5 bis 5.000 gleichzeitigen Anfragen abgerufen. Im Durchschnitt über alle Parallelitätsstufen verzeichnete Decodo die schnellste Medianantwort von etwa 7 Sekunden bei einer Erfolgsquote von 59%, während Bright Data mit 76% bei einer medianen Antwortzeit von 16 Sekunden…
Beste RAG Werkzeuge, Frameworks und Bibliotheken
RAG verbessert LLM-Antworten, indem es sie auf externen Daten fundiert, anstatt nur auf dem, was das Modell während des Trainings auswendig gelernt hat. Wir haben die Komponenten, aus denen ein RAG-System aufgebaut ist, einem Benchmark unterzogen und die Ergebnisse an einem Ort zusammengestellt, mit einem praktischen Leitfaden zur Auswahl jedes Teils des Stacks. Sehen Sie…
Vektordatenbank-Benchmark: 7 Open-Source-Engines für RAG
Wir haben sieben quelloffene, selbst gehostete Vektordatenbanken als Abrufschicht einer RAG-Pipeline getestet, wobei jede einzeln mit identischen bge-m3-Embeddings und realen medizinischen und technischen Anfragen ausgeführt wurde, sodass der Datenbankindex die einzige Variable war. Das Pensum umfasste MedRAG-50k, TechQA-28k und einen 2.25M-Vektor-Korpus über acht Dimensionen, von Genauigkeit und Abrufqualität über Geschwindigkeit, Speicher, gefilterte und hybride Suche,…
GPU Nebenläufigkeits-Benchmark: H100 vs H200 vs B200 vs MI300X
Ich habe die letzten 20 Jahre damit verbracht, mich auf die Optimierung der Rechenleistung auf Systemebene zu konzentrieren. Wir haben die neuesten NVIDIA GPUs einem Benchmark unterzogen, darunter die NVIDIA H100, H200 und B200 sowie die AMD MI300X, zur Analyse der Nebenläufigkeitsskalierung. Mit dem vLLM-Framework und dem gpt-oss-20b-Modell haben wir getestet, wie diese GPUs gleichzeitige…
Text-to-SQL: Vergleich der Genauigkeit von LLMs
Ich verlasse mich seit 18 Jahren auf SQL für die Datenanalyse, begonnen in meiner Zeit als Berater. Die Übersetzung von natürlichsprachlichen Fragen in SQL macht Daten zugänglicher und ermöglicht es jedem, auch Personen ohne technische Kenntnisse, direkt mit Datenbanken zu arbeiten. Wir haben unsere Benchmark-Methodik für Text-to-SQL auf über 35 große Sprachmodelle (LLMs) angewendet, um…
AIMultiple Newsletter
1 kostenlose E-Mail pro Woche mit den neuesten B2B-Technachrichten und Experten Einblicken.