Ekrem Sarı
Ekrem é pesquisador de IA na AIMultiple, com foco em automação inteligente, GPUs, agentes de IA e LLMOps para frameworks RAG.
Experiência profissional
Durante sua atuação como Avaliador na Yandex, ele avaliou resultados de busca utilizando frameworks proprietários e protocolos automatizados. Implementou testes de controle de qualidade por meio de anotação de dados, pontuação de relevância e mapeamento da intenção do usuário em mais de 10.000 consultas mensais, além de conduzir avaliações técnicas, incluindo monitoramento de desempenho e detecção de spam utilizando ciclos de feedback de aprendizado de máquina.Interesse de pesquisa
Na AIMultiple, sua pesquisa se concentra no ciclo de vida de MLOps e no desempenho e benchmarking de sistemas de IA de ponta a ponta. Ele contribui para uma ampla gama de projetos, incluindo otimização de Geração Aumentada por Recuperação (RAG), benchmarking extensivo de Modelos de Linguagem Amplos (LLM) e o design de frameworks de IA para agentes. Ekrem se especializa no desenvolvimento de metodologias orientadas a dados para medir e aprimorar o desempenho da tecnologia de IA em métricas operacionais críticas, como precisão, eficiência, custo de API e escalabilidade. Sua análise abrange toda a pilha de tecnologia, desde componentes fundamentais, como modelos de incorporação e bancos de dados vetoriais, até a infraestrutura de nuvem e GPU de alto desempenho necessária para a implantação de agentes de IA.Educação
Ekrem é bacharel pela Hacettepe Üniversitesi e mestre pela Başkent Üniversitesi.Últimos artigos de Ekrem
Top 60+ Provedores de Cloud GPU
Os provedores de cloud GPU se dividem em três níveis. Os hyperscalers operam plataformas de nuvem amplas com aluguel de GPU como um produto entre muitos. Os neoclouds especializados focam em infraestrutura de GPU e IA como seu produto principal. Os marketplaces comunitários agregam inventário de muitos pequenos operadores, frequentemente no piso da faixa de…
Comparação dos 6 Melhores Serviços Gratuitos de Cloud GPU
O melhor tier free de GPU vale cerca de $19 por mês em taxas de aluguel, e oito plataformas oferecem uma GPU real sem cartão de crédito. Seis delas limitam o uso free por mês, e nós precificamos essas com base na taxa sob demanda atual mais barata para cada GPU em nossos dados de…
Benchmark de software de backup: Acronis vs NinjaOne vs Comet vs MSP360
Comparamos o NinjaOne Backup, Acronis Cyber Protect Cloud Backup, Comet Backup e MSP360 Managed Backup em infraestrutura AWS idêntica. Cada fornecedor executou um backup em modo de arquivo da mesma carga de trabalho de 625.946 arquivos / 50 GB e um backup completo de imagem do disco do sistema, depois restaurou o subdiretório médio de…
Calculadora de Dimensionamento e Seleção de Banco de Dados Vetorial
A questão prática por trás de um banco de dados vetorial auto-hospedado para RAG é qual mecanismo se adapta a um determinado servidor e qual deles a carga de trabalho descarta. A calculadora abaixo responde a ambas, a partir do nosso benchmark de sete bancos de dados vetoriais auto-hospedados executados com recall correspondente em embeddings…
Benchmark de Recuperação de Desastres: Acronis vs Comet vs MSP360
Comparamos o Acronis Cyber Protect Cloud, o Comet Backup e o MSP360 Managed Backup na recuperação de desastres. Cada fornecedor criou uma imagem de um Windows Server 2022 ativo e de um servidor Ubuntu 24.04 ativo, ambos com a mesma carga de trabalho determinística, um serviço web, uma base de dados de 10.000 linhas e…
Extrator de E-Commerce: 6 Fornecedores Avaliados
Avaliamos cinco fornecedores de dados web em 100 domínios de e-commerce, recolhendo 65.000 páginas de produto e pesquisa em cada um, com 5 a 5.000 pedidos concorrentes. Com a média calculada entre os níveis de concorrência, a Decodo registou a mediana de resposta mais rápida, cerca de 7 segundos, com uma taxa de sucesso de…
Melhores RAG Ferramentas, Frameworks e Bibliotecas
RAG melhora as respostas dos LLMs ao fundamentá-las em dados externos, em vez de apenas o que o modelo memorizou durante o treinamento. Avaliamos os componentes a partir dos quais um sistema RAG é construído e reunimos os resultados em um só lugar, com um guia prático para escolher cada parte da stack. Veja nossos…
Benchmark de Bancos de Dados Vetoriais: 7 Motores de Código Aberto para RAG
Fizemos o benchmark de sete bancos de dados vetoriais de código aberto e auto-hospedados como camada de recuperação de um pipeline de RAG, cada um executado individualmente em embeddings bge-m3 idênticos e consultas médicas e técnicas reais, de modo que o índice do banco de dados foi a única variável. A carga de trabalho abrangeu…
GPU Benchmark de Simultaneidade: H100 vs H200 vs B200 vs MI300X
Passei os últimos 20 anos focado em otimização de desempenho computacional em nível de sistema. Realizamos benchmark das mais recentes GPUs da NVIDIA, incluindo a NVIDIA H100, H200 e B200, e a AMD MI300X, para análise de escalonamento de simultaneidade. Usando a framework vLLM com o modelo gpt-oss-20b, testamos como estas GPUs lidam com solicitações…
Texto-para-SQL: Comparação da Precisão de LLMs
Eu dependo do SQL para análise de dados há 18 anos, desde os meus tempos de consultor. Traduzir perguntas em linguagem natural para SQL torna os dados mais acessíveis, permitindo que qualquer pessoa, mesmo aquelas sem habilidades técnicas, trabalhe diretamente com bancos de dados. Utilizámos a nossa metodologia de benchmark de texto-para-SQL em mais de…
Boletim informativo AIMultiple
Receba um e-mail gratuito por semana com as últimas notícias de tecnologia B2B e insights de especialistas para impulsionar o seu negócio.