Avaliamos os principais scrapers do Twitter (X) em 1.000 URLs, totalizando 5.000 solicitações. Para ajudá-lo a escolher a ferramenta certa para seus projetos de scraping do Twitter, categorizamos os melhores desempenhos abaixo.
Benchmark dos scrapers do Twitter (X)
Como todos os provedores atingiram 100% de taxa de sucesso, comparamos o tempo de conclusão deles.
Veja nossa metodologia de benchmark para mais detalhes.
Quais dados podem ser extraídos do Twitter
Ao fazer scraping de um post do Twitter, você normalmente obtém um de dois formatos de resposta: HTML bruto (que você analisa com seletores CSS para extrair os campos de que precisa) ou uma carga JSON pronta.
Bright Data foi o único provedor em nosso teste que retornou JSON, portanto a tabela abaixo lista os campos de metadados que ele expõe.
Scrapers do Twitter gratuito teste
Os preços refletem o plano padrão de cada provedor. O custo por 1K pode variar entre os pacotes.
As melhores ferramentas de scraping do Twitter
Bright Data Twitter Scraper API foi o provedor mais rápido em nosso benchmark, com ~4 segundos por tweet, retornando JSON totalmente estruturado com 33 campos de metadados, sem necessidade de análise de HTML no lado do cliente (contagens de engajamento, perfil do autor, mídia incorporada, detalhes de post pai/citado, verificação).
Bright Data também oferece outros scrapers específicos do Twitter e datasets prontos:
- Posts, coletar por URL: extrai dados de um tweet pela sua URL. Usamos Posts, coletar por URL para o benchmark dos scrapers do Twitter.
- Posts, descobrir por URL de perfil: coleta todas as URLs das postagens e seus dados de um perfil
- Perfis, coletar por URL: extrai detalhes do perfil de uma URL de perfil
- Perfis, descobrir por nome de usuário: coleta perfis por nome de usuário
Bright Data também oferece mídia social datasets prontos por meio de seu Dataset Marketplace, incluindo Posts e Perfis do Twitter pré-coletados.
Comece gratuito, 5.000 registros/mês sem necessidade de cartão de crédito
Obtenha Acesso GrátisOxylabs ficou em torno de 15 segundos por tweet, colocando-o perto do lado mais lento do grupo. Sua API em tempo real retorna HTML renderizado por meio da fonte universal, e as contagens de engajamento mais o texto da postagem são recuperados com seletores CSS no lado do cliente.
Decodo foi o provedor mais lento no benchmark de scrapers do Twitter, com cada tweet levando cerca de 16 segundos. Seu scraper universal v2 retorna o HTML completo renderizado no servidor, que o cliente então analisa para as quatro contagens de interação (resposta, repost, curtida, bookmark) e a contagem de visualizações.
Zyte retorna uma página totalmente renderizada por meio de seu endpoint browserHtml em uma única chamada. Foi o segundo provedor mais rápido no benchmark, concluindo cada tweet em cerca de 8 segundos. A saída é HTML, portanto a análise no lado do cliente ainda é necessária para extrair contagens de engajamento e o texto do tweet.
Nimble usa seu driver stealth vx10, que combina renderização completa de JS com evasão anti-bot. Levou cerca de 11 segundos por tweet no benchmark. A resposta é HTML, analisada no lado do cliente para extrair contagens de engajamento e o conteúdo da postagem.
Metodologia de benchmark dos scrapers do Twitter
Testamos cinco provedores de scraping (Bright Data, Decodo, Nimble, Oxylabs, Zyte) em um dataset fixo de 1.000 posts públicos do Twitter. Cada provedor recebeu a mesma lista de URLs e o resultado de cada raspagem foi validado contra a mesma verdade de referência.
Cada solicitação foi enviada com configurações padrão; nenhum ajuste específico do provedor ou reutilização de sessão foi aplicado.
O que medimos
- Taxa de sucesso de validação: a parcela de solicitações em que os dados raspados corresponderam à verdade de referência.
- Tempo de ponta a ponta: total de segundos desde o envio da solicitação até a extração do resultado, incluindo polling assíncrono para provedores que trabalham no modo enviar-depois-consultar.
- Total de campos de metadados: número de campos que o provedor retorna por tweet.
Regras de validação
Cada post raspado é verificado em relação a seis critérios:
- URL: o ID do tweet extraído da resposta deve corresponder à URL solicitada.
- Descrição: pelo menos três tokens alfanuméricos em letras minúsculas devem se sobrepor entre o texto raspado e o texto de referência. Ignorado se a verdade de referência tiver menos de três tokens.
- Contagem de respostas: dentro da tolerância do valor de referência.
- Contagem de reposts: dentro da tolerância.
- Contagem de curtidas: dentro da tolerância.
- Contagem de bookmarks: dentro da tolerância.
Um post é marcado como válido se pelo menos três desses seis critérios forem aprovados. Critérios em que a verdade de referência é nula são ignorados; critérios em que a verdade de referência existe, mas o valor raspado está ausente, são contados como falha.
Fórmula de tolerância para contagens
As contagens de engajamento no Twitter são dinâmicas (curtidas e visualizações continuam aumentando), e o próprio X.com arredonda números grandes na interface (“6K” em vez de 6.121). Para permitir essas pequenas diferenças, cada verificação de contagem usa a seguinte tolerância:
Exemplos:
- N = 2 → tolerância ±3 (intervalo [0, 5])
- N = 100 → tolerância ±10 (intervalo [90, 110])
- N = 1.000 → tolerância ±50 (intervalo [950, 1.050])
- N = 1.000.000 → tolerância ±50.000
Isso dá uma margem relativa mais ampla para contagens pequenas e uma margem relativa mais estreita para as grandes.
Validação de código de status
- HTTP 200: a resposta é levada para extração e validação.
- HTTP 201 a 399: contado como sucesso sem verificações de conteúdo.
- HTTP 404: contado como sucesso (o provedor relatou corretamente uma página ausente).
- Qualquer outro código de status: contado como falha.
Perguntas frequentes
O tratamento jurídico do scraping de dados públicos da web sob leis como a CFAA depende da jurisdição e do contexto.
Os Termos do X proíbem crawling ou scraping sem permissão por escrito e impõem danos liquidados de $15,000, ou €15.000 na UE/EFTA/Reino Unido, para cada 1.000.000 posts acessados em 24 horas. 1
Um scraper do Twitter é um software que extrai dados do Twitter. Ele permite que os usuários coletem vários tipos de dados associados ao conteúdo e aos usuários do Twitter, como perfis de usuários, hashtags e tweets.
Perfis do Twitter: Descrição do perfil, imagem, nome de usuário e contagens de seguidores/seguindo.
Tweets: Metadados associados ao conteúdo de um tweet, incluindo curtidas, retweets e respostas.
Hashtags: Você pode coletar tweets contendo hashtags específicas.
Listas do Twitter: Nomes de listas, descrições e associações.
Cite este benchmark
Escolha o formato adequado ao local onde você vai publicar. Colar a versão com link no seu CMS preserva o backlink.
@misc{sipi2026,
author = {Şipi, Nazlı},
title = {{Melhores Scrapers do Twitter (X): Benchmark}},
year = {2026},
month = jun,
howpublished = {\url{https://aimultiple.com/twitter-scraper}},
note = {AIMultiple. Acessado em 25 Junho 2026}
}Resultados e carimbos de data/hora de 10 pontos de dados. Baixe os dados utilizados neste artigo como um arquivo ZIP contendo 2 arquivos CSV.
Registro de alterações
18 atualizações- 2026
Removida a seção "Como raspar dados do Twitter".
- 2025
Reduzida a seção "Resultados de benchmark do Scraper".
Atualizada a seção de resultados do benchmark do Scraper com novos dados de desempenho.
Atualizada a seção de metodologia de benchmark com novos detalhes sobre o número de URLs, tipos de solicitação e datas.
Adicionado Apify à lista dos melhores scrapers do Twitter.
Reduzido o número de URLs testadas na metodologia.
Atualizado o preço inicial para Nimble.
- 2024
Adicionada uma seção, "Recursos da tabela explicados", à introdução.
Substituída a seção "Benchmark methodology" por dados de "Response times".
Adicionada metodologia de benchmark à seção de metodologia.
Apify foi substituído por Nimble na seção 'Melhores Scrapers de Twitter (X)'.
Adicionado Apify à lista dos principais scrapers do Twitter (X).
Substituída a seção de metodologia.
Removido o produto Smartproxy da seção "Melhores scrapers do Twitter para extração de dados do Twitter".
Adicionado NetNut à lista dos melhores "scrapers" de Twitter.
- 2023
Adicionado Nimble à lista de scrapers do Twitter.
A introdução foi atualizada para refletir a mudança de marca do Twitter para X.
Adicionada uma tabela de comparação rápida à introdução.
Seja o primeiro a comentar
Seu endereço de e-mail não será publicado. Todos os campos são obrigatórios. Os comentários são deixados em seu idioma original.