Web Agêntica
Benchmarks de infraestrutura de IA para a web, incluindo navegadores remotos para agentes e navegadores de IA para humanos.
Melhores 30+ Agentes Web de Código Aberto
Testamos 30+ agentes web de código aberto em quatro categorias: agentes autônomos, controladores de uso de computador, web scrapers e frameworks para desenvolvedores. Executamos benchmarks idênticos usando a suíte de testes WebVoyager, que abrange 643 tarefas em 15 sites reais, para medir quais ferramentas realmente completam tarefas web de múltiplas etapas e quais falham quando…
Navegadores Remotos: Infraestrutura Web para Agentes de IA Comparada
Os agentes de IA dependem de navegadores remotos para automatizar tarefas web sem serem bloqueados por medidas anti-scraping. O desempenho desta infraestrutura de navegador é fundamental para o sucesso de um agente. Avaliámos 8 fornecedores quanto à taxa de sucesso, velocidade e funcionalidades. Para isso, executámos 160 tarefas automatizadas, executando 4 cenários distintos 5 vezes…
Busca Agêntica: Benchmark 8 Search APIs para Agentes
A busca agêntica desempenha um papel crucial na ligação entre os motores de busca tradicionais e as capacidades de busca com IA. As APIs de busca são a primeira camada de uma ferramenta agêntica, onde o desempenho limita a qualidade de tudo a jusante. Avaliamos 8 APIs de busca em 100 consultas reais de IA/LLM,…
Pesquisa Aprofundada de IA: Claude vs ChatGPT vs Grok
A pesquisa aprofundada de IA oferece aos utilizadores uma gama mais ampla de resultados de pesquisa do que os motores de busca de IA. Para ver o desempenho de diferentes ferramentas de pesquisa aprofundada de IA, introduzimos três novos benchmarks: Bench DR-50 (Deep Research 50), que avalia ferramentas em 50 perguntas abrangendo seis tipos de…