Ekrem Sarı
Ekrem é pesquisador de IA na AIMultiple, com foco em automação inteligente, GPUs, agentes de IA e LLMOps para frameworks RAG.
Experiência profissional
Durante sua atuação como Avaliador na Yandex, ele avaliou resultados de busca utilizando frameworks proprietários e protocolos automatizados. Implementou testes de controle de qualidade por meio de anotação de dados, pontuação de relevância e mapeamento da intenção do usuário em mais de 10.000 consultas mensais, além de conduzir avaliações técnicas, incluindo monitoramento de desempenho e detecção de spam utilizando ciclos de feedback de aprendizado de máquina.Interesse de pesquisa
Na AIMultiple, sua pesquisa se concentra no ciclo de vida de MLOps e no desempenho e benchmarking de sistemas de IA de ponta a ponta. Ele contribui para uma ampla gama de projetos, incluindo otimização de Geração Aumentada por Recuperação (RAG), benchmarking extensivo de Modelos de Linguagem Amplos (LLM) e o design de frameworks de IA para agentes. Ekrem se especializa no desenvolvimento de metodologias orientadas a dados para medir e aprimorar o desempenho da tecnologia de IA em métricas operacionais críticas, como precisão, eficiência, custo de API e escalabilidade. Sua análise abrange toda a pilha de tecnologia, desde componentes fundamentais, como modelos de incorporação e bancos de dados vetoriais, até a infraestrutura de nuvem e GPU de alto desempenho necessária para a implantação de agentes de IA.Educação
Ekrem é bacharel pela Hacettepe Üniversitesi e mestre pela Başkent Üniversitesi.Últimos artigos de Ekrem
Comparativo de software de backup: Acronis vs NinjaOne vs Comet vs MSP360
Comparamos o Acronis Cyber Protect Cloud Backup, Comet Backup, MSP360 Managed Backup e NinjaOne Backup em infraestrutura AWS idêntica. Cada fornecedor executou um backup em modo de arquivo da mesma carga de trabalho de 625.946 arquivos / 50 GB e um backup completo de imagem do disco do sistema, e depois restaurou o subdiretório médio…
Mais de 60 Principais Provedores de GPU em Nuvem
Os provedores de GPU em nuvem se dividem em três níveis. Hyperscalers operam plataformas de nuvem amplas com aluguel de GPU como um produto entre muitos. Neoclouds especializadas focam em GPU e infraestrutura de IA como seu produto principal. Marketplaces comunitários agregam inventário de muitos pequenos operadores, frequentemente no piso da faixa de preços publicada.…
Cloud GPU Preços, Desempenho e Comparação de Fornecedores
Os preços de tabela de Cloud GPU para o mesmo modelo podem diferir várias vezes de um fornecedor para outro. Selecionámos o preço mais baixo, fornecedor, intervalo de mercado e mediana para mais de 40 configurações de GPU nos três níveis de preços, mais um benchmark de débito por dólar em 10 modelos. Veja a…
Benchmark de Recuperação de Desastres: Acronis vs Comet vs MSP360
Comparamos o Acronis Cyber Protect Cloud, o Comet Backup e o MSP360 Managed Backup na recuperação de desastres. Cada fornecedor criou uma imagem de um servidor Windows Server 2022 ativo e de um servidor Ubuntu 24.04 com a mesma carga de trabalho determinística, um serviço web, uma base de dados de 10.000 linhas e 50…
Índice de Preços de Locação de GPU na Nuvem
As tarifas sob demanda para as GPUs de última geração em nuvem (B200, B300, MI300X, RTX 5090) aproximadamente dobraram no último ano, enquanto as placas convencionais (H100, H200, A100) mantiveram uma faixa estreita. Compilamos o índice de GPU mensalmente de 63 provedores e 17 modelos de GPU, abrangendo os níveis sob demanda, spot e reservado…
Raspador de E-Commerce: 6 Fornecedores Avaliados
Avaliamos seis fornecedores de dados web em 100 domínios de e-commerce, obtendo 65.000 páginas de produtos e pesquisa cada, com 5 a 5.000 solicitações simultâneas. Na média dos níveis de simultaneidade, Decodo registrou a resposta mediana mais rápida, cerca de 7 segundos, com uma taxa de sucesso de 59%, enquanto Bright Data alcançou a maior…
LLM Calculadora de VRAM para Auto-hospedagem
Auto-hospedar um LLM significa executar a inferência em hardware controlado pelo operador, em vez de via uma API de terceiros, o que altera o custo, o controlo dos dados e o perfil de privacidade. O facto de um modelo conseguir sequer correr depende da memória. A calculadora estima a VRAM ou a memória unificada de…
Benchmark de 40+ LLMs em Finanças: Claude Fable 5 & GPT-5.6 Sol
Avaliamos 40+ LLMs em finanças em 238 perguntas difíceis do benchmark FinanceReasoning para identificar quais modelos se destacam em tarefas complexas de raciocínio financeiro, como análise de demonstrações, previsões e cálculos de índices. Avaliamos LLMs em 238 perguntas difíceis do benchmark FinanceReasoning (Tang et al.).1 Este subconjunto tem como alvo as tarefas de raciocínio financeiro…
Benchmark de Modelos de Embedding de Código Aberto para RAG
Avaliamos 14 modelos de embedding de código aberto, auto-hospedados em uma única H100, em mais de 500 consultas de recuperação curadas manualmente, abrangendo contratos legais, notas técnicas de suporte ao cliente e resumos médicos. NVIDIA Llama-Embed-Nemotron-8B lidera em precisão. Em custo, o EmbeddingGemma-300m do Google é aproximadamente 4x mais barato que o Nemotron, ao custo…
Comparação dos 6 Melhores Serviços Gratuitos de GPU na Nuvem
A melhor camada free GPU vale cerca de $19 por mês nas taxas de aluguel, e oito plataformas oferecem uma GPU real sem cartão de crédito. Seis delas limitam o uso free por mês, e nós precificamos essas pelo menor preço atual sob demanda para cada GPU em nossos dados de precificação de GPU na…
Boletim informativo AIMultiple
Receba um e-mail gratuito por semana com as últimas notícias de tecnologia B2B e insights de especialistas para impulsionar o seu negócio.