Nazlı Şipi
Ela também faz parte da equipe de benchmark, com foco em grandes modelos de linguagem (LLMs), agentes de IA e frameworks agênticos.
Nazlı possui mestrado em Business Analytics pela University of Denver.
Últimos artigos de Nazlı
Raspagem de Dados do Craigslist: Melhores Raspadores do Craigslist
A estrutura de páginas do Craigslist permaneceu praticamente inalterada por anos, simples, HTML principalmente estático, com pouco JavaScript e poucas defesas anti-bot. Para ver como os raspadores lidam com essa simplicidade, executamos 500 anúncios de emprego do Craigslist em 5 fornecedores, totalizando 2.500 solicitações, e medimos a taxa de sucesso e o tempo de conclusão…
LLM Benchmark de Latência por Casos de Uso
Fizemos o benchmark de 11 dos principais modelos de linguagem de grande escala com um total de 1.320 pedidos, dividindo modelos de raciocínio e não-raciocínio, e medimos a latência do primeiro token, a latência por token e o tempo total de resposta. Pode encontrar detalhes sobre como medimos a latência aqui. Relatamos modelos de raciocínio…
Top 5 Scrapers Web para Indeed Comparados
Avaliamos 5 provedores de web scraping em anúncios de emprego do Indeed com 2.500 requisições, medindo taxa de sucesso, tempo de conclusão e saída de metadados. Você pode ler nossa metodologia de benchmark para mais detalhes sobre nosso processo de testes. Bright Data foi o único provedor a retornar JSON estruturado para o Indeed, entregando…
15 Ferramentas de Observabilidade de Agentes de IA: AgentOps e Langfuse
As ferramentas de observabilidade de agentes de IA, como Langfuse e Arize, ajudam a reunir rastros detalhados (um registro da execução de um programa ou transação) e fornecem painéis para acompanhar métricas em tempo real. Muitos frameworks de agentes, como o LangChain, utilizam o padrão OpenTelemetry para compartilhar metadados com o monitoramento agentivo. Além disso,…
Comparar Modelos de IA Multimodais em Raciocínio Visual
Avaliámos 15 modelos de IA multimodais líderes em raciocínio visual utilizando 200 perguntas baseadas em imagens. A avaliação consistiu em duas pistas: 100 perguntas de compreensão de gráficos testando a interpretação de visualizações de dados, e 100 perguntas de lógica visual avaliando o reconhecimento de padrões e o raciocínio espacial. Cada pergunta foi executada 5…
Os 6 principais raspadores da Apple App Store: Bright Data, SerpAPI & Zyte
Testamos 6 provedores de web scraping em 1.000 páginas da Apple App Store, totalizando 6.000 solicitações, e medimos taxa de sucesso, tempo de conclusão e o número de campos de metadados retornados por cada provedor. Como todos os provedores alcançaram taxa de sucesso de 100%, concentramos nossa comparação no número de campos de metadados retornados…
Top 5 APIs de Coleta de Anúncios de Vagas Comparadas API
Avaliamos 5 provedores líderes de raspagem de dados da web em 5 grandes plataformas de emprego executando 12.500 solicitações no total, depois medimos a taxa de sucesso de cada provedor, o tempo de conclusão e a saída de metadados. Você pode ler a seção de metodologia do benchmark para mais detalhes sobre o processo de…
Principais 6 Web Scrapers de Entrega de Alimentos: Benchmark e Casos de Uso
Realizamos um benchmark de 6 provedores de web scraping para ver como eles lidam com a extração de dados de entrega de alimentos, enviando 12.000 solicitações no total nas principais 4 plataformas de entrega de alimentos, e medimos a taxa de sucesso, o tempo de conclusão e a cobertura de metadados. Veja a seção metodologia…
Boletim informativo AIMultiple
Receba um e-mail gratuito por semana com as últimas notícias de tecnologia B2B e insights de especialistas para impulsionar o seu negócio.