O CrowdTangle acabou. A história do substituto é um alerta sobre a vida útil das ferramentas
De tempos em tempos surge uma notícia que é nominalmente sobre o produto de outra pessoa e que na verdade trata de um risco estrutural. A desta semana é a reportagem do Nieman Lab de 9 de setembro de 2026 sobre o Arbiter, uma ferramenta de IA da organização sem fins lucrativos SimPPL que tenta ocupar o espaço que a Meta deixou quando encerrou o CrowdTangle em 2024. Li o texto inteiro esperando um perfil de produto direto. O que encontrei foi um relato lúcido do que custa depender de uma ferramenta que você não controla.
É esse fio que quero puxar, porque ele se aplica muito além do jornalismo. Qualquer pessoa que monitore, capture ou cite conteúdo social público corre o mesmo risco, e o setor passou os últimos três anos provando isso repetidamente.
O que era o CrowdTangle, e o que o substituiu
O CrowdTangle foi a ferramenta que jornalistas, checadores de fatos e pesquisadores usaram por mais de uma década para observar como o conteúdo se espalhava pelo Facebook e pelo Instagram. A Meta reduziu o investimento aos poucos e depois anunciou, em março de 2024, que encerraria as operações em agosto. Uma petição assinada por mais de 100 grupos de vigilância alertou, nas palavras citadas pelo Nieman Lab, que "quase todos os esforços externos para identificar e prevenir desinformação política, incitação à violência e assédio online contra mulheres e minorias serão silenciados".
A Meta chegou a lançar um sucessor: a Meta Content Library, disponibilizada em novembro de 2023. A recepção foi, na melhor das hipóteses, mista. O Nieman Lab observa que ela tem sido criticada por restringir o acesso de jornalistas e por remover os insights automatizados e a busca sofisticada que tornavam o CrowdTangle útil. Duuya Baatar, cofundadora do Nest Center em Ulan Bator, resumiu a diferença de forma direta para a reportagem: se você quer olhar uma publicação ou narrativa específica, a Meta Content Library serve; se você quer analisar como um ecossistema de informação está mudando, ela não chega perto do CrowdTangle.
É essa lacuna que o Arbiter pretende atacar, e o formato da ferramenta vale ser entendido porque mostra onde estão as partes difíceis:
| Dimensão | CrowdTangle (encerrado em 2024) | Meta Content Library | Arbiter (SimPPL) |
|---|---|---|---|
| Cobertura de plataformas | Facebook, Instagram | Apenas produtos da Meta | Facebook, Instagram, X, YouTube, TikTok, Reddit, Bluesky, 4chan |
| Ponto forte | Volume e rastreamento de disseminação | Publicações e contas específicas, com acesso mais profundo a volume | Linhas de tendência e narrativas emergentes entre plataformas |
| Abordagem | Dados fornecidos pela plataforma | Dados da plataforma, com acesso restrito | APIs, bases acadêmicas e fornecedores terceiros de raspagem |
| Custo para redações | Gratuito | Condicionado a aprovação de acesso | Gratuito enquanto as organizações estão testando |
| Quem opera | Meta | Meta | SimPPL, organização 501(c)(3) dos EUA fundada em 2021 |
Por que o fundador construiu de forma independente, nas palavras dele
Aqui está a parte que deve interessar a qualquer um que já tenha construído um fluxo de trabalho sobre o acesso a dados de outra pessoa. Swapneel Mehta, cofundador e presidente da SimPPL, explicou seu raciocínio ao Nieman Lab, e é uma restrição de projeto dita sem rodeios:
"O CrowdTangle não é um serviço que foi obrigado ou regulado a continuar sendo oferecido em momento algum. As plataformas poderiam decidir que aquilo não era um saldo líquido positivo e parar de oferecê-lo."
Ele completa com a posição que busca construir: "Estas são conversas públicas, e coletar conversas públicas no interesse público não deveria ser ilegal."
Há uma segunda citação que mostra como o fluxo funciona de fato sob carga, e é honestamente pouco glamourosa sobre o papel da IA:
"Qualquer um que já tenha lidado com mais de 100 mil peças de dados sabe que jogá-las primeiro em um LLM estoura a fatura do cartão e depois entrega resultados inúteis que você não consegue controlar."
A resposta do Arbiter não é um modelo, mas oito a dez deles, cada um fazendo uma tarefa diferente: codificar consultas, recuperar as publicações certas, identificar redes coordenadas, medir similaridade semântica, mapear redes. Algumas camadas são agnósticas de modelo, e as redações podem usar o provedor de LLM que preferirem. É uma arquitetura sensata, e também um lembrete de que "adicionamos IA" não é o mesmo que "resolvemos a recuperação".
A parte desconfortável: o acesso é emprestado
Até uma ferramenta independente bem construída está a jusante das plataformas. O Arbiter passou por processos de revisão de vários meses para obter acesso às APIs do Facebook e do Instagram, e continua sujeito aos limites de requisições da Meta: usando apenas a API, ele só consegue puxar uma quantidade limitada de publicações por vez. Para ampliar essa abertura, Mehta descreveu o trabalho com fornecedores terceiros de dados que mantêm acordos comerciais, a identificação de exceções para coletar dados públicos sem violar os termos de serviço, e o recurso a doações de dados de acadêmicos e organizações da sociedade civil.
Ele também não romantiza o arranjo. Mehta disse ao Nieman Lab que esses processos costumam começar de forma favorável porque uma organização pequena não parece uma preocupação para a gestão, e que "à medida que você cresce, o tipo de trabalho que você faz muda". A equipe tem advogados revisando suas soluções alternativas de API em busca de vulnerabilidades, o que é uma precaução razoável diante do histórico: o X processou o Center for Countering Digital Hate em 2023 por suposta raspagem e uso de uma ferramenta terceira de escuta social, caso que mais tarde foi arquivado.
O padrão a observar: uma ferramenta de uma década que as redações tratavam como infraestrutura foi descontinuada no cronograma de um fornecedor, seu substituto oficial estreitou o acesso, e o sucessor independente funciona com uma mistura de APIs, acordos com fornecedores e dados raspados que o próprio fundador descreve como algo com que não pode contar. Nada disso é uma crítica ao Arbiter. É uma descrição do terreno.
O relatório britânico diz em voz alta o que todos pensam
Dois dias antes da matéria do Nieman Lab, o Tech Policy Press publicou, em 8 de setembro de 2026, um artigo ligado a um relatório da Força-Tarefa de Acesso a Dados de Plataformas Sociais do Reino Unido. Ele nomeia a condição diretamente, descrevendo o que chama de ambiente pós-API e um descompasso crescente entre a demanda por evidências independentes sobre plataformas e as rotas disponíveis para produzi-las. O mesmo artigo registra a linha do tempo: o X retirou sua API gratuita de pesquisa para acadêmicos em 2023, e a Meta encerrou o CrowdTangle no ano seguinte.
Sua conclusão é a que vale carregar adiante para qualquer pessoa que arquive conteúdo social, seja qual for a profissão:
"A raspagem de dados já é um método de pesquisa estabelecido e continua sendo uma das poucas formas pelas quais pesquisadores podem coletar de modo independente dados de plataformas de acesso público."
Leia isso junto com a reportagem do Nieman Lab e você obtém um quadro coerente. As portas oficiais se estreitaram. As portas restantes — raspagem, acordos com fornecedores, doações de dados, provedores terceiros — são aquelas em que todos se apoiam, e são justamente as que carregam mais incerteza jurídica e técnica.
Então o que quem arquiva deveria fazer diferente?
Nada nessa história muda o fato de que ferramentas de monitoramento são úteis. A capacidade do Arbiter de sinalizar uma narrativa emergente semanas antes é genuinamente valiosa: a reportagem conta de uma redação mongol que a usou para identificar contas promovendo um enquadramento de "difamação e calúnia" de um processo parlamentar antes que o grupo de trabalho fosse anunciado. Isso é sinal real.
A lição é sobre qual camada você trata como durável. Concretamente:
- Separe a descoberta do registro. O trabalho de uma ferramenta de monitoramento é dizer que algo está acontecendo. O trabalho do seu arquivo é guardar o que foi dito de fato. São sistemas diferentes com vidas úteis diferentes, e só um deles está sob seu controle.
- Guarde o texto da publicação, não apenas o ponteiro. Um resultado de busca salvo ou um link permanente é uma referência dentro do sistema de outra pessoa. As palavras, o autor e o carimbo de data são a evidência.
- Presuma que qualquer rota de acesso pode fechar. O CrowdTangle foi estrutural por mais de uma década e fechou. Uma API gratuita de pesquisa fechou. Os limites de requisições se apertaram. Nada disso foi anunciado como catástrofe; foi apenas uma decisão que outra pessoa tomou.
- Mantenha o arquivo portável. Arquivos em um formato que você consegue ler sem o painel de um fornecedor são a diferença entre um registro que você possui e um registro ao qual você tem acesso emprestado.
- Verifique antes de citar. Se uma citação depende de um token, de um nome de usuário ou de uma ferramenta que existia quando você capturou, confirme que ela ainda resolve do jeito que você descreveu.
Um pequeno script captura a distinção melhor do que a prosa. O ThreadGrab expõe perfis públicos em JSON, que você pode converter em Markdown que sobrevive à ferramenta que o encontrou:
# Capture the posts themselves, not a pointer to a dashboard
curl -s https://threadgrab.com/api/profile/USERNAME \
-H "Accept: application/json" \
| jq -r '.posts[] | "## " + .created_at + "\n\n" + .text + "\n\nsource: " + .url + "\n"' \
> archive/public-thread-USERNAME.md
# Record the observation date, so the capture is a dated claim
date -u +"captured_at: %Y-%m-%dT%H:%M:%SZ" \
>> archive/public-thread-USERNAME.md
O segundo comando importa mais do que parece. Um arquivo que registra quando foi capturado é uma afirmação sobre um momento. Um arquivo que não registra é uma alegação sobre o presente que expira em silêncio.
E se você já tem uma pasta de capturas cuja origem não tem certeza, esta checagem encontra as que dependem inteiramente de um serviço externo ativo:
# List captures that store only a link and no post text of their own
for f in archive/*.md; do
if ! grep -q '^## ' "$f"; then
echo "pointer-only capture: $f"
fi
done
# Anything printed above depends on a service staying up.
# Re-fetch each one and store the post text alongside the link.
O que observar a seguir
- Se o modelo de receita do Arbiter se sustenta. Todas as redações que o testam o fazem de graça, e Mehta disse ao Nieman Lab que tem consciência de que muitas organizações que precisam da ferramenta têm poucos recursos. Uma ferramenta gratuita de interesse público com uma organização sem fins lucrativos por trás tem uma curva de durabilidade diferente da de um produto comercial — melhor em alguns aspectos, pior em outros.
- Se o acesso às APIs das plataformas vai se ampliar ou se estreitar. A cobertura do Arbiter depende de exceções e acordos com fornecedores que não têm garantia de persistir. O trabalho da força-tarefa britânica é a expressão política da mesma questão.
- Se a responsabilidade por raspagem será testada de novo nos tribunais. O processo do CCDH foi arquivado, mas o perímetro legal da coleta de conversas públicas ainda está sendo desenhado, e quem constrói ferramentas é quem descobre onde estão as linhas.
- Se o acesso à Meta Content Library vai melhorar. Se melhorar, a urgência de alternativas independentes cai. Se continuar restrito, espere mais projetos no estilo da SimPPL.
As limitações deste artigo
- Tudo aqui se baseia em reportagem secundária. Não testei a saída do Arbiter e não posso verificar suas alegações de cobertura de forma independente. As citações são reproduzidas do texto do Nieman Lab de 9 de setembro de 2026 e do artigo do Tech Policy Press de 8 de setembro de 2026.
- Preços e termos de acesso são alvos móveis. O Nieman Lab relata que todo o uso atual por redações é gratuito e que a SimPPL ainda está explorando fontes de receita. Isso pode mudar; confirme antes de contar com isso.
- "Ambiente pós-API" é um argumento, não uma estatística medida. É uma caracterização justa de uma série de decisões restritivas, mas é um enquadramento, não uma métrica.
- Não usei o CrowdTangle nem a Meta Content Library. Minha descrição do que cada um fazia bem vem da reportagem e de profissionais nomeados citados nela, não de uma comparação prática.
Perguntas frequentes
O que substituiu o CrowdTangle depois que a Meta o encerrou?
O substituto oficial da Meta é a Meta Content Library, lançada em novembro de 2023. Ela tem sido criticada por restringir o acesso de jornalistas e por eliminar os insights automatizados e a busca sofisticada que o CrowdTangle oferecia. De forma independente, a organização sem fins lucrativos SimPPL criou o Arbiter, uma ferramenta de IA que coleta publicações do Facebook, Instagram, X, YouTube, TikTok, Reddit, Bluesky e 4chan. O Nieman Lab relatou em 9 de setembro de 2026 que o Arbiter começou a integrar redações neste ano, incluindo Deutsche Welle, Chequeado e Rappler, com usuários de mais de 100 organizações registrados.
O Arbiter substitui completamente o CrowdTangle?
Não, e quem usa a ferramenta diz isso abertamente. Duuya Baatar, do Nest Center na Mongólia, disse ao Nieman Lab que a única preocupação que ouve da equipe é o volume de conteúdo que o Arbiter consegue efetivamente recuperar das fontes. Ela descreveu a combinação prática como Meta Content Library mais Arbiter chegando perto do CrowdTangle, em vez de qualquer uma delas substituindo a outra sozinha. O Arbiter é mais forte em linhas de tendência e narrativas emergentes entre plataformas; o acesso direto às plataformas é mais forte em volume e no monitoramento de contas específicas.
Por que os pesquisadores chamam isso de ambiente pós-API?
Porque as rotas oficiais para dados de plataformas se estreitaram repetidamente. O Tech Policy Press, em 8 de setembro de 2026, ao comentar um relatório da Força-Tarefa de Acesso a Dados de Plataformas Sociais do Reino Unido, descreveu um descompasso crescente entre a demanda por evidências independentes sobre plataformas e as rotas disponíveis para produzi-las. O mesmo texto registra que o X retirou sua API gratuita de pesquisa para acadêmicos em 2023, e que a Meta encerrou o CrowdTangle no ano seguinte. A raspagem de dados é descrita nesse relatório como um método de pesquisa estabelecido e uma das poucas formas restantes de coletar de modo independente dados de plataformas de acesso público.
O Arbiter faz raspagem direta das plataformas?
Em parte. O Nieman Lab relata que o Arbiter coleta dados de APIs de redes sociais, bases acadêmicas e empresas terceirizadas de raspagem de dados. Ele passou por processos de revisão de vários meses para obter acesso às APIs de grandes plataformas, incluindo Facebook e Instagram, e continua sujeito aos limites de requisições da Meta. Para ampliar esse acesso, o cofundador Swapneel Mehta disse que trabalhou com fornecedores terceiros que mantêm acordos comerciais, identificou exceções para coletar dados públicos sem violar os termos de serviço, e contou com doações de dados de acadêmicos e organizações da sociedade civil.
Se uma ferramenta de IA pode monitorar narrativas por mim, por que arquivar algo sozinho?
Porque a camada de monitoramento e o registro são coisas diferentes, e a camada de monitoramento é a que fica mudando. O CrowdTangle foi essencial por mais de uma década e depois deixou de ser oferecido. O próprio fundador do Arbiter resume isso de forma direta: as plataformas poderiam decidir que uma ferramenta não era um saldo líquido positivo e parar de oferecê-la, e é por isso que ele constrói de forma independente. Uma ferramenta diz o que está em alta agora. Um arquivo que você controla diz o que alguém realmente publicou, nas palavras dessa pessoa, com um carimbo de data que você pode citar depois, independentemente da ferramenta da moda naquele ano.
Qual é a conclusão prática para quem arquiva conteúdo social?
Trate a ferramenta de plataforma e o seu próprio arquivo como duas camadas separadas com vidas úteis diferentes. Use qualquer superfície de monitoramento disponível neste ano para descobrir coisas, e guarde o texto da publicação, a URL de origem e o carimbo de data em arquivos Markdown portáveis para tudo que você possa precisar citar depois. Ferramentas são emprestadas e podem ser retiradas. Uma captura em um formato que você possui é a parte que sobrevive à retirada.
Última verificação: 11 de setembro de 2026. Fontes primárias: Nieman Lab, "Two years ago, Meta killed CrowdTangle. Can a new AI tool fill the void?" de Andrew Deck (9 de setembro de 2026); Tech Policy Press, "Why the UK Needs Better Social Media Data Access to Research Online Harms" (8 de setembro de 2026); páginas do projeto SimPPL em simppl.org e arbiter.simppl.org; e a cobertura do Nieman Lab de 2024 sobre o encerramento do CrowdTangle. Todas as citações nomeadas são reproduzidas da reportagem do Nieman Lab e do artigo do Tech Policy Press. Preços de ferramentas, termos de acesso e disponibilidade de APIs de plataformas devem ser rechecados antes de serem usados como base.
Mantenha um registro que não depende da ferramenta de outra pessoa
O ThreadGrab transforma conteúdo público do X, Bluesky e LinkedIn em Markdown limpo e com carimbo de data — para que as conversas que importam continuem legíveis mesmo depois que uma ferramenta de monitoramento for descontinuada.
Experimentar o ThreadGrab →