Ekrem Sarı
Ekrem é Pesquisador de IA e Cientista de Dados na AIMultiple. Ele projeta e executa benchmarks práticos para sistemas de IA e LLM.
Experiência Profissional
Na AIMultiple, Ekrem realiza benchmarks de sistemas de IA de ponta a ponta e constrói os fluxos de trabalho de dados e dashboards usados para acompanhar métricas de benchmark e de produto. Seus benchmarks abrangem models de embedding e reranker, bancos de dados vetoriais e de grafos, motores de inference, quantização, concorrência de GPU e escalonamento multi-GPU, preços e fornecedores de GPU na nuvem, text-to-SQL, e frameworks de RAG e RAG agêntico.
Antes da AIMultiple, ele trabalhou como Cientista de Dados na Yandex, onde consultou e analisou grandes datasets com SQL para avaliar a qualidade de busca e ranqueamento segundo diretrizes detalhadas.
Interesse de Pesquisa
O trabalho de Ekrem concentra-se em medir como os sistemas de LLM e de recuperação se comportam na prática. Ele projeta o ambiente de teste, executa as cargas de trabalho em hardware real e compara models, frameworks e infraestrutura em precisão, vazão, latência, custo e escalabilidade, em toda a stack, desde models de embedding e bancos de dados vetoriais até motores de inference e infraestrutura de GPU. Sua tese de mestrado automatiza revisões sistemáticas de literatura com uma pipeline baseada em RAG.
Educação
Ekrem possui um mestrado em Sistemas de Informação Gerenciais pela Başkent University, onde sua tese automatizou revisões sistemáticas de literatura com uma pipeline baseada em RAG, e está cursando um segundo mestrado em Engenharia de Dados e Conhecimento na Hacettepe University.
Últimos artigos de Ekrem
LLM Calculadora de VRAM para Auto-Hospedagem
Auto-hospedar um LLM significa executar a inferência em hardware que o operador controla, em vez de via uma API de terceiros, o que altera o custo, o controle de dados e o perfil de privacidade. O fato de um modelo executar ou não depende da memória. A calculadora estima a VRAM ou memória unificada que…
Navegadores Remotos: Infraestrutura Web para Agentes de IA Comparada
Os agentes de IA dependem de navegadores remotos para automatizar tarefas web sem serem bloqueados por medidas anti-scraping. O desempenho dessa infraestrutura de navegador é fundamental para o sucesso de um agente. Avaliamos 8 provedores quanto à taxa de sucesso, velocidade e recursos. Para isso, executamos 160 tarefas automatizadas, executando 4 cenários distintos 5 vezes…
Melhores RAG Ferramentas, Frameworks e Bibliotecas
RAG melhora as respostas de LLM ao fundamentá-las em dados externos em vez de apenas no que o modelo memorizou no treinamento. Fizemos benchmark dos componentes dos quais um sistema RAG é construído e reunimos os resultados em um só lugar, com um guia prático para escolher cada parte da stack. Veja nossos resultados de…
Os 30+ principais fabricantes de chips de IA: NVIDIA e seus concorrentes
Com base em nossa experiência executando o GPU benchmark em nuvem do AIMultiple com 10 modelos de GPU diferentes em 4 cenários diferentes, estas são as principais empresas de hardware de IA para cargas de trabalho de data center. *O chip de IA selecionado é a peça, plataforma ou projeto anunciado que melhor representa cada…
Cloud GPU Rental Price Index
As tarifas sob demanda para as GPUs de nuvem de geração mais recente (B200, B300, MI300X, RTX 5090) praticamente dobraram no último ano, enquanto as placas mainstream (H100, H200, A100) mantiveram uma faixa estreita. Compilamos o índice de GPU mensalmente a partir de 69 provedores e 17 modelos de GPU, cobrindo os níveis sob demanda,…
Text-to-SQL: Comparação da precisão de LLM
Executamos 36 grandes modelos de linguagem em 759 perguntas do BIRD-SQL, cada modelo escrevendo SQL contra um banco de dados que precisava identificar por si mesmo entre 11 candidatos. Toda consulta analisável foi executada no banco de dados real e seu conjunto de resultados comparado com o conjunto de resultados da consulta gold do BIRD.…
GPU Benchmark de Concorrência: H100 vs H200 vs B200 vs MI300X
Passei os últimos 20 anos focando na otimização de desempenho computacional em nível de sistema. Avaliamos as mais recentes NVIDIA GPUs, incluindo as NVIDIA H100, H200 e B200, e a AMD MI300X, para análise de escalabilidade de concorrência. Usando o framework vLLM com o gpt-oss-20b model, testamos como essas GPUs lidam com solicitações simultâneas, de…
Detecção de bot: 9 fornecedores anti-bot avaliados em benchmark
Executamos dois benchmarks contra sites ativos, identificamos a empresa anti-bot à frente de cada domínio e medimos com que frequência os domínios de cada empresa retornaram o conteúdo solicitado. Isso cobre mais de 3.800 domínios rotulados e mais de 50.000 solicitações. O primeiro benchmark buscou páginas de produto e de busca em 100 domínios de…
Scraper de E-commerce: 4 Provedores Avaliados
Avaliamos quatro provedores de dados da web em 100 domínios de e-commerce, coletando 65.000 páginas de produto e de busca cada um, com 5 a 5.000 solicitações simultâneas. Na média entre os níveis de simultaneidade, Bright Data alcançou a maior taxa de sucesso (76%) com uma mediana de 16 segundos. Apify registrou o maior tempo…
Busca agêntica: Benchmark de 8 APIs de busca para agentes
A busca agêntica desempenha um papel crucial na redução da lacuna entre os mecanismos de busca tradicionais e os recursos de busca com IA. As APIs de busca são a primeira camada de uma ferramenta agêntica, e o desempenho limita a qualidade de tudo o que vem a jusante. Avaliamos 8 APIs de busca em…
Boletim informativo AIMultiple
Receba um e-mail gratuito por semana com as últimas notícias de tecnologia B2B e insights de especialistas para impulsionar o seu negócio.