Ekrem Sarı
Ekrem é Pesquisador de IA e Analista de Dados na AIMultiple. Ele projeta e executa benchmarks práticos para sistemas de IA e LLM.
Experiência Profissional
Na AIMultiple, Ekrem faz benchmarks de sistemas de IA de ponta a ponta e constrói os fluxos de trabalho de dados e painéis usados para acompanhar métricas de benchmark e de produto. Seus benchmarks abrangem models de embedding e reranker, bancos de dados vetoriais e de grafos, mecanismos de inference, quantização, concorrência de GPU e escalonamento multi-GPU, preços e provedores de GPU em nuvem, text-to-SQL e frameworks de RAG e RAG agêntico.
Antes da AIMultiple, ele trabalhou como Avaliador na Yandex, onde avaliou a qualidade da pesquisa e rotulou grandes volumes de dados segundo diretrizes detalhadas para apoiar a qualidade de classificação e de model.
Interesse de Pesquisa
O trabalho de Ekrem se concentra no ciclo de vida de MLOps e LLMOps e na medição do desempenho de sistemas de IA. Ele compara models, frameworks e infraestrutura em métricas como acurácia, throughput, custo de API e escalabilidade, em toda a pilha, desde models de embedding e bancos de dados vetoriais até GPU e infraestrutura de nuvem. Sua dissertação de mestrado automatiza revisões sistemáticas da literatura com um pipeline baseado em RAG.
Educação
Ekrem possui bacharelado pela Hacettepe University e está concluindo um mestrado na Başkent University.
Últimos artigos de Ekrem
Web Scraping em Grande Escala: 7 Provedores Comparados
Realizámos dois benchmarks em websites reais, de 5 a 5.000 pedidos simultâneos. O primeiro enviou 260.000 pedidos através de quatro desbloqueadores web pelos 10.000 domínios do topo do Tranco, mais um teste de extração de markdown em 10.000 URLs. O segundo recolheu 65.000 páginas de produto e pesquisa de cada um dos cinco fornecedores de…
Comparação dos 6 Melhores Serviços Gratuitos de Cloud GPU
O melhor tier gratuito de GPU vale cerca de $19 por mês em taxas de aluguel, e oito plataformas oferecem uma GPU real sem cartão de crédito. Seis delas limitam o uso gratuito por mês, e nós precificamos essas com base na taxa sob demanda atual mais barata para cada GPU em nossos dados de…
Calculadora de Dimensionamento e Seleção de Banco de Dados Vetorial
A questão prática por trás de um banco de dados vetorial auto-hospedado para RAG é qual mecanismo se adapta a um determinado servidor e qual deles a carga de trabalho descarta. A calculadora abaixo responde a ambas, a partir do nosso benchmark de sete bancos de dados vetoriais auto-hospedados executados com recall correspondente em embeddings…
Melhores RAG Ferramentas, Frameworks e Bibliotecas
RAG melhora as respostas dos LLMs ao fundamentá-las em dados externos, em vez de apenas o que o modelo memorizou durante o treinamento. Avaliamos os componentes a partir dos quais um sistema RAG é construído e reunimos os resultados em um só lugar, com um guia prático para escolher cada parte da stack. Veja nossos…
Benchmark de Bancos de Dados Vetoriais: 7 Motores de Código Aberto para RAG
Fizemos o benchmark de sete bancos de dados vetoriais de código aberto e auto-hospedados como camada de recuperação de um pipeline de RAG, cada um executado individualmente em embeddings bge-m3 idênticos e consultas médicas e técnicas reais, de modo que o índice do banco de dados foi a única variável. A carga de trabalho abrangeu…
Cloud GPU Preços, Desempenho e Comparação de Fornecedores
Os preços de tabela de Cloud GPU para o mesmo modelo podem diferir várias vezes de um fornecedor para outro. Selecionámos o preço mais baixo, fornecedor, intervalo de mercado e mediana para mais de 40 configurações de GPU nos três níveis de preços, mais um benchmark de débito por dólar em 10 modelos. Veja a…
Índice de Preços de Locação de GPU na Nuvem
As tarifas sob demanda para as GPUs de última geração em nuvem (B200, B300, MI300X, RTX 5090) aproximadamente dobraram no último ano, enquanto as placas convencionais (H100, H200, A100) mantiveram uma faixa estreita. Compilamos o índice de GPU mensalmente de 63 provedores e 17 modelos de GPU, abrangendo os níveis sob demanda, spot e reservado…
LLM Calculadora de VRAM para Auto-hospedagem
Auto-hospedar um LLM significa executar a inferência em hardware controlado pelo operador, em vez de via uma API de terceiros, o que altera o custo, o controlo dos dados e o perfil de privacidade. O facto de um modelo conseguir sequer correr depende da memória. A calculadora estima a VRAM ou a memória unificada de…
Principais Funções Sem Servidor: Vercel vs Azure vs AWS
Funções sem servidor permitem que os desenvolvedores executem código sem precisar gerenciar um servidor. Isso permite que eles se concentrem em escrever e implantar aplicativos enquanto o dimensionamento e a manutenção da infraestrutura são tratados automaticamente em segundo plano. Neste benchmark, avaliamos 7 provedores populares de serviços em nuvem seguindo nossa metodologia para testar o…
RAG Ferramentas de Avaliação: Weights & Biases vs Ragas vs DeepEval
Quando um pipeline de RAG recupera o contexto errado, o LLM gera confiantemente a resposta errada. Os avaliadores de relevância de contexto são a principal defesa. Comparamos cinco ferramentas em 1.460 perguntas e mais de 14.600 contextos pontuados sob condições idênticas: mesmo modelo juiz (GPT-4o), configurações padrão e sem prompts personalizados. Em condições padrão, WandB,…
Boletim informativo AIMultiple
Receba um e-mail gratuito por semana com as últimas notícias de tecnologia B2B e insights de especialistas para impulsionar o seu negócio.