Serviços
Contate-nos
Ekrem Sarı

Ekrem Sarı

Pesquisador de IA
35 Artigos
Mantenha-se atualizado sobre tecnologia B2B.

Ekrem é Pesquisador de IA e Cientista de Dados na AIMultiple. Ele projeta e executa benchmarks práticos para sistemas de IA e LLM.

Experiência Profissional

Na AIMultiple, Ekrem realiza benchmarks de sistemas de IA de ponta a ponta e constrói os fluxos de trabalho de dados e dashboards usados para acompanhar métricas de benchmark e de produto. Seus benchmarks abrangem models de embedding e reranker, bancos de dados vetoriais e de grafos, motores de inference, quantização, concorrência de GPU e escalonamento multi-GPU, preços e fornecedores de GPU na nuvem, text-to-SQL, e frameworks de RAG e RAG agêntico.

Antes da AIMultiple, ele trabalhou como Cientista de Dados na Yandex, onde consultou e analisou grandes datasets com SQL para avaliar a qualidade de busca e ranqueamento segundo diretrizes detalhadas.

Interesse de Pesquisa

O trabalho de Ekrem concentra-se em medir como os sistemas de LLM e de recuperação se comportam na prática. Ele projeta o ambiente de teste, executa as cargas de trabalho em hardware real e compara models, frameworks e infraestrutura em precisão, vazão, latência, custo e escalabilidade, em toda a stack, desde models de embedding e bancos de dados vetoriais até motores de inference e infraestrutura de GPU. Sua tese de mestrado automatiza revisões sistemáticas de literatura com uma pipeline baseada em RAG.

Educação

Ekrem possui um mestrado em Sistemas de Informação Gerenciais pela Başkent University, onde sua tese automatizou revisões sistemáticas de literatura com uma pipeline baseada em RAG, e está cursando um segundo mestrado em Engenharia de Dados e Conhecimento na Hacettepe University.

Últimos artigos de Ekrem

IA
Análise
31 Ago

LLM Calculadora de VRAM para Auto-Hospedagem

Auto-hospedar um LLM significa executar a inferência em hardware que o operador controla, em vez de via uma API de terceiros, o que altera o custo, o controle de dados e o perfil de privacidade. O fato de um modelo executar ou não depende da memória. A calculadora estima a VRAM ou memória unificada que…

Dados
Benchmark
31 Ago

Navegadores Remotos: Infraestrutura Web para Agentes de IA Comparada

Os agentes de IA dependem de navegadores remotos para automatizar tarefas web sem serem bloqueados por medidas anti-scraping. O desempenho dessa infraestrutura de navegador é fundamental para o sucesso de um agente. Avaliamos 8 provedores quanto à taxa de sucesso, velocidade e recursos. Para isso, executamos 160 tarefas automatizadas, executando 4 cenários distintos 5 vezes…

IA
Benchmark
31 Ago

Melhores RAG Ferramentas, Frameworks e Bibliotecas

RAG melhora as respostas de LLM ao fundamentá-las em dados externos em vez de apenas no que o modelo memorizou no treinamento. Fizemos benchmark dos componentes dos quais um sistema RAG é construído e reunimos os resultados em um só lugar, com um guia prático para escolher cada parte da stack. Veja nossos resultados de…

IA
Comparação de Recursos
26 Ago

Os 30+ principais fabricantes de chips de IA: NVIDIA e seus concorrentes

Com base em nossa experiência executando o GPU benchmark em nuvem do AIMultiple com 10 modelos de GPU diferentes em 4 cenários diferentes, estas são as principais empresas de hardware de IA para cargas de trabalho de data center. *O chip de IA selecionado é a peça, plataforma ou projeto anunciado que melhor representa cada…

IA
Comparação de Recursos
25 Ago

Cloud GPU Rental Price Index

As tarifas sob demanda para as GPUs de nuvem de geração mais recente (B200, B300, MI300X, RTX 5090) praticamente dobraram no último ano, enquanto as placas mainstream (H100, H200, A100) mantiveram uma faixa estreita. Compilamos o índice de GPU mensalmente a partir de 69 provedores e 17 modelos de GPU, cobrindo os níveis sob demanda,…

IA
Benchmark
24 Ago

Text-to-SQL: Comparação da precisão de LLM

Executamos 36 grandes modelos de linguagem em 759 perguntas do BIRD-SQL, cada modelo escrevendo SQL contra um banco de dados que precisava identificar por si mesmo entre 11 candidatos. Toda consulta analisável foi executada no banco de dados real e seu conjunto de resultados comparado com o conjunto de resultados da consulta gold do BIRD.…

IA
Benchmark
24 Ago

GPU Benchmark de Concorrência: H100 vs H200 vs B200 vs MI300X

Passei os últimos 20 anos focando na otimização de desempenho computacional em nível de sistema. Avaliamos as mais recentes NVIDIA GPUs, incluindo as NVIDIA H100, H200 e B200, e a AMD MI300X, para análise de escalabilidade de concorrência. Usando o framework vLLM com o gpt-oss-20b model, testamos como essas GPUs lidam com solicitações simultâneas, de…

Cibersegurança
Benchmark
21 Ago

Detecção de bot: 9 fornecedores anti-bot avaliados em benchmark

Executamos dois benchmarks contra sites ativos, identificamos a empresa anti-bot à frente de cada domínio e medimos com que frequência os domínios de cada empresa retornaram o conteúdo solicitado. Isso cobre mais de 3.800 domínios rotulados e mais de 50.000 solicitações. O primeiro benchmark buscou páginas de produto e de busca em 100 domínios de…

Dados
Benchmark
21 Ago

Scraper de E-commerce: 4 Provedores Avaliados

Avaliamos quatro provedores de dados da web em 100 domínios de e-commerce, coletando 65.000 páginas de produto e de busca cada um, com 5 a 5.000 solicitações simultâneas. Na média entre os níveis de simultaneidade, Bright Data alcançou a maior taxa de sucesso (76%) com uma mediana de 16 segundos. Apify registrou o maior tempo…

IA Agêntica
Benchmark
20 Ago

Busca agêntica: Benchmark de 8 APIs de busca para agentes

A busca agêntica desempenha um papel crucial na redução da lacuna entre os mecanismos de busca tradicionais e os recursos de busca com IA. As APIs de busca são a primeira camada de uma ferramenta agêntica, e o desempenho limita a qualidade de tudo o que vem a jusante. Avaliamos 8 APIs de busca em…