Ekrem Sarı
Ekrem ist KI-Forscher bei AIMultiple und konzentriert sich auf intelligente Automatisierung, GPUs, KI-Agenten und LLMOps für RAG-Frameworks.
Berufserfahrung
Während seiner Tätigkeit als Assessor bei Yandex bewertete er Suchergebnisse mithilfe firmeneigener Frameworks und automatisierter Protokolle. Er implementierte Qualitätssicherungstests durch Datenannotation, Relevanzbewertung und Nutzerintention-Mapping für monatlich über 10.000 Suchanfragen und führte gleichzeitig technische Bewertungen durch, darunter Leistungsüberwachung und Spam-Erkennung mithilfe von ML-Feedbackschleifen.Forschungsinteresse
Bei AIMultiple konzentriert sich seine Forschung auf den MLOps-Lebenszyklus sowie die Leistungsfähigkeit und das Benchmarking von End-to-End-KI-Systemen. Er wirkt an einer Vielzahl von Projekten mit, darunter die Optimierung von Retrieval-Augmented Generation (RAG), umfassende Benchmarking-Studien für große Sprachmodelle (LLM) und die Entwicklung agentenbasierter KI-Frameworks. Ekrem ist spezialisiert auf die Entwicklung datengetriebener Methoden zur Messung und Verbesserung der Leistungsfähigkeit von KI-Technologien anhand kritischer Kennzahlen wie Genauigkeit, Effizienz, API-Kosten und Skalierbarkeit. Seine Analysen umfassen den gesamten Technologie-Stack, von grundlegenden Komponenten wie Einbettungsmodellen und Vektordatenbanken bis hin zur leistungsstarken GPU- und Cloud-Infrastruktur, die für den Einsatz von KI-Agenten erforderlich ist.Ausbildung
Ekrem hat einen Bachelor-Abschluss der Hacettepe Üniversitesi und einen Master-Abschluss der Başkent Üniversitesi.Neueste Artikel von Ekrem
Top 60+ Cloud GPU Anbieter
Cloud-GPU-Anbieter lassen sich in drei Stufen einteilen. Hyperscaler betreiben breite Cloud-Plattformen, bei denen die GPU-Vermietung ein Produkt unter vielen ist. Spezialisierte Neoclouds konzentrieren sich auf GPU- und KI-Infrastruktur als ihr Kernprodukt. Community-Marktplätze bündeln Inventar von vielen kleinen Betreibern, oft zu den niedrigsten Preisen der veröffentlichten Preisspanne. Wir verfolgen 67 Cloud-GPU-Anbieter und 14 kuratierte GPU-Modellfamilien mit…
Cloud GPU Preise, Leistung & Anbietervergleich
Cloud GPU Listenpreise für dasselbe Modell können sich von Anbieter zu Anbieter um ein Vielfaches unterscheiden. Wir haben den niedrigsten Preis, den Anbieter, die Marktspanne und den Median für 40+ GPU-Konfigurationen in allen drei Preismodellen sowie einen Durchsatz-pro-Dollar-Benchmark für 10 Modelle zusammengestellt. Sehen Sie die kosteneffektivste GPU für Ihre Workload über 13 Hyperscaler- und Neocloud-Anbieter,…
Disaster Recovery-Benchmark: Acronis vs Comet vs MSP360
Wir haben Acronis Cyber Protect Cloud, Comet Backup und MSP360 Managed Backup im Bereich Disaster Recovery einem Benchmark unterzogen. Jeder Anbieter erstellte ein Image eines laufenden Windows Server 2022 und eines laufenden Ubuntu 24.04-Servers, die dieselbe deterministische Arbeitslast, einen Webdienst, eine 10 000-zeilige Datenbank sowie 50 Dateien ausführten. Anschließend stellte er den gesamten Rechner auf…
Cloud GPU-Mietpreisindex
Die On-Demand-Preise für Cloud-GPUs der neuesten Generation (B200, B300, MI300X, RTX 5090) haben sich im vergangenen Jahr etwa verdoppelt, während Mainstream-Karten (H100, H200, A100) in einem engen Band blieben. Wir erstellen den GPU-Index monatlich aus 63 Anbietern und 17 GPU-Modellen und decken dabei On-Demand-, Spot- und 1-Jahres-Reservierungsstufen ab. Das Diagramm zeigt den monatlichen Median-Preis über…
Backup-Software-Benchmark: Acronis vs NinjaOne vs Comet vs MSP360
Wir haben Acronis Cyber Protect Cloud Backup, Comet Backup, MSP360 Managed Backup und NinjaOne Backup auf identischer AWS-Infrastruktur verglichen. Jeder Anbieter führte ein dateiorientiertes Backup derselben 625,946-Dateien / 50 GB Arbeitslast sowie ein vollständiges Image-Backup der Systemfestplatte durch und stellte anschließend das 15 GB große mittlere Unterverzeichnis wieder her. Hier sind die vier getesteten Backup-Produkte…
E-Commerce Scraper: 6 Anbieter im Benchmark-Test
Wir haben sechs Webdaten-Anbieter über 100 E-Commerce-Domains getestet und 65.000 Produkt- und Suchseiten jeweils mit 5 bis 5.000 gleichzeitigen Anfragen abgerufen. Im Durchschnitt über alle Parallelitätsstufen verzeichnete Decodo die schnellste mediane Antwortzeit von etwa 7 Sekunden bei einer Erfolgsquote von 59%, während Bright Data die höchste Erfolgsquote (76%) bei einem Median von 16 Sekunden erreichte.…
LLM VRAM-Rechner für Selbsthosting
Einen LLM selbst zu hosten bedeutet, die Inferenz auf Hardware auszuführen, die der Betreiber kontrolliert, anstatt über eine API eines Drittanbieters, was die Kosten, die Datenkontrolle und das Datenschutzprofil verändert. Ob ein Modell überhaupt läuft, hängt vom Speicher ab. Der Rechner schätzt den benötigten VRAM oder vereinheitlichten Speicher, um ein Modell lokal auszuführen, basierend auf…
Benchmark von 40+ LLMs im Finanzwesen: Claude Fable 5 & GPT-5.6 Sol
Wir haben 40+ LLMs im Finanzwesen anhand von 238 schwierigen Fragen aus dem FinanceReasoning-Benchmark evaluiert, um herauszufinden, welche Modelle bei komplexen Finanzlogik-Aufgaben wie Bilanzanalyse, Prognosen und Kennzahlenberechnungen hervorragend sind. Wir haben LLMs auf 238 schwierigen Fragen aus dem FinanceReasoning-Benchmark (Tang et al.) evaluiert.1 Diese Untergruppe zielt auf die anspruchsvollsten Finanzlogik-Aufgaben ab und bewertet komplexe, mehrstufige…
Benchmark für Open-Source-Einbettungsmodelle für RAG
Wir haben 14 Open-Source-Einbettungsmodelle auf einer einzelnen H100 selbst gehostet und anhand von über 500 manuell kuratierten Abfrageanfragen getestet, die Rechtsverträge, technische Support-Notizen und medizinische Zusammenfassungen abdecken. NVIDIA Llama-Embed-Nemotron-8B führt in der Genauigkeit. Bei den Kosten läuft Google EmbeddingGemma-300m etwa 4x günstiger als Nemotron, bei einem kleinen Genauigkeitsverlust. nDCG@3: Normalisierter kumulierter diskontierter Nutzen bei Cutoff…
Vergleich der Top 6 kostenlosen Cloud-GPU-Dienste
Die beste free GPU-Stufe ist etwa $19 pro Monat bei Mietpreisen wert, und acht Plattformen bieten eine echte GPU ohne Kreditkarte. Sechs davon beschränken die free-Nutzung pro Monat, und wir haben diese zum günstigsten aktuellen On-Demand-Preis für jede GPU in unseren Cloud-GPU-Preisdaten bewertet. Jeder Balken stellt die Mietkosten für dieselbe GPU-Zeit dar, berechnet als die…
AIMultiple Newsletter
1 kostenlose E-Mail pro Woche mit den neuesten B2B-Technachrichten und Experten Einblicken.