API do X (Twitter) para pesquisa acadêmica

Quando o X encerrou o Academic Research Track gratuito em 2023, sumiram o arquivo completo e o acesso de alto volume que sustentaram quase duas décadas de pesquisa publicada sobre o Twitter. Sorsa API traz esse acesso de volta, grátis ou com desconto para pesquisadores não comerciais verificados.

  • Busca no arquivo completo que remonta a março de 2006, com os operadores avançados em que os pesquisadores se apoiavam: from:, to:, since:, until:, lang:, frases exatas e hashtags.
  • Hidrate ou reidrate até 100 IDs de tweet por requisição, substituindo direto os fluxos já mortos do Hydrator e do twarc sobre a API oficial.
  • Acesso somente leitura a dados públicos com uma chave de API : sem aprovação de conta de desenvolvedor, sem OAuth e sem contrato empresarial de US$ 42 mil.

Ou escreva direto para a gente: contacts@sorsa.io


A lacuna

O que os pesquisadores perderam em 2023

Por dezessete anos a API do Twitter foi a principal fonte de dados em ciência política, saúde pública, ciências sociais computacionais, estudos de comunicação e linguística. Ela sustentou trabalhos sobre eleições, desinformação e comunicação de crise. O Academic Research Track dava aos pesquisadores aprovados busca no arquivo completo até 2006 e cerca de 10 milhões de tweets por mês. Anunciado em fevereiro de 2023, o acesso gratuito à API foi cortado naquela primavera, e em meados de 2023 os endpoints acadêmicos saíram do ar por completo. Os planos substitutos ofereciam pouco para pesquisa: um plano básico de US$ 100 sem acesso histórico, ou um contrato empresarial a partir de cerca de US$ 42 mil por mês. Mais de cem estudos foram cancelados ou suspensos. Para um olhar mais fundo sobre como acessar tweets antigos, veja nosso guia de dados históricos do Twitter.


Recursos

Tudo o que você precisa para montar um dataset do Twitter

Diferencial principal

Reidratação por ID de tweet para datasets compartilhados

Datasets de pesquisa compartilhados circulam como listas de IDs de tweet, para respeitar os termos do X. Reidratá-los exigia a API oficial via ferramentas como o DocNow Hydrator ou o twarc, e as duas quebraram quando o acesso gratuito e o acadêmico acabaram. O endpoint em lote da Sorsa aceita até 100 IDs de tweet por requisição e devolve o JSON completo do tweet com os perfis dos autores, sem conta de desenvolvedor e sem OAuth. Cada tweet ainda traz view_count e bookmark_count , métricas de engajamento que a API oficial não expõe para tweets de terceiros.

1.000.000 de IDs de tweet na Sorsa, a cota mensal inteira do plano Starter de US$ 49
US$ 49
10.000 requisições em lote · 100 IDs cada
O mesmo volume na API oficial do X, cobrado por leitura de post
~US$ 5.000
preço por leitura de post

Busca no arquivo completo que remonta a 2006

Pesquise todo o arquivo público com a sintaxe de busca avançadado Twitter: from: e to: para coleta por conta, since: e until: para janelas de data, lang: para filtrar idioma, além de frases exatas e hashtags. Monte datasets longitudinais, janelas de eventos e corpora de palavras-chave como o Academic Track permitia. Veja nosso guia de desenvolvimento sobre buscar tweets pela API, ou como baixar todos os tweets de uma conta.

Datasets reprodutíveis e compartilháveis

Toda resposta inclui IDs estáveis de tweet e de usuário, então você pode publicar uma lista de IDs em conformidade com os termos junto do artigo e deixar que outros reproduzam a sua coleta. A saída é JSON limpo, que entra direto no R, no pandas ou no seu notebook, pronto para análise de sentimento e outros pipelines seguintes.

Acesso simples e amigável à ética em pesquisa

Uma chave de API num cabeçalho de requisição, somente leitura, apenas dados públicos. Não há nada a publicar e nenhuma conta em nome de quem agir, o que deixa a coleta fácil de descrever para o IRB ou o comitê de ética. Sem fila de solicitação e sem espera por aprovação.


Como o acesso se compara

Academic Track, API oficial do X e Sorsa

Academic Research Trackantes de 2023API oficial do X2026, pagamento por usoSorsapreço fixo por requisição
Busca no arquivo completoSim, até 2006Só no plano enterpriseSim, até 2006
Volume mensal~10 milhões de tweetsMedido por leitura de postPlanos fixos, qualquer volume
Processo de aprovaçãoSolicitação e análise, semanasAprovação de conta de desenvolvedorNenhum, chave de API na hora
Começar de graçaExige solicitaçãoNenhum100 requisições grátis
AutenticaçãoOAuth e bearer tokenOAuth 2.0Um cabeçalho com a chave de API
Custo por 1 milhão de tweetsGrátis, se aprovado~US$ 5.000Grátis ou com desconto para acadêmicos
Métricas de engajamentoCurtidas, retweets, respostasLimitadas para tweets de terceirosCurtidas, retweets, respostas, mais view_count e bookmark_count

Experiência de desenvolvimento

Reidrate um dataset em poucas linhas

Envie até 100 IDs de tweet por chamada, percorra o seu dataset em lotes de 100 e grave os resultados em .ndjson para análise. A configuração completa está na documentação de dados históricos.

Python
import requests

ids = ["1266876474440761346", "1266868259925737474"]  # up to 100 per request

res = requests.post(
    "https://api.sorsa.io/v3/tweet-info-bulk",
    headers={"ApiKey": "YOUR_API_KEY"},
    json={"tweet_links": ids},
)

for tweet in res.json()["tweets"]:
    print(tweet["full_text"], tweet["user"]["username"])

Para pesquisadores

Acesso acadêmico grátis e com desconto

Quem se qualifica: docentes, pós-doutorandos, estudantes de doutorado e de mestrado, e pesquisadores da sociedade civil em projetos não comerciais. Dissertações de mestrado, teses de doutorado e estudos financiados de docentes contam. O que você recebe: uma cota grátis de requisições para estudos piloto, ou um desconto permanente nos planos pagos para coletas maiores. respondemos em dois dias úteis.

Para solicitar, escreva para contacts@sorsa.io do seu e-mail institucional (.edu ou o domínio da sua universidade), ou use o formulário abaixo: descreva a sua pergunta de pesquisa e como vai usar os dados, e confirme que o trabalho é não comercial. Fornecemos uma carta de uso de dados e conformidade para submissões ao IRB e a comitês de ética, se você pedir. Planos com preço fixo por requisição também entram como uma linha fixa e previsível em propostas de financiamento, diferente da cobrança por uso da API oficial.

Solicitar acesso acadêmico

Seu trabalho vai além da pesquisa acadêmica?

Se o seu uso é comercial, ou se você só quer acesso padrão à API sem solicitar nada, temos planos com preço fixo por requisição para qualquer volume. O detalhamento completo está na página de preços.

Ver preços

Cenário representativo

Como os pesquisadores usam a Sorsa

3,2 mi
de IDs de tweet = 32.000 requisições em lote, bem abaixo de um mês de Pro

Imagine um grupo de comunicação estudando o discurso eleitoral, com um dataset de 3,2 milhões de IDs de tweet compartilhado por um laboratório parceiro. Depois do fim do Academic Track, um pipeline com twarc como o deles devolveria apenas erros de autenticação. No endpoint em lote da Sorsa, esses 3,2 milhões de IDs viram 32.000 requisições em lote de 100, cerca de um terço de um único mês de Pro, e aproximadamente 30 minutos de relógio a 20 requisições por segundo. A reidratação continua sem contrato empresarial e sem mudar a metodologia de coleta.


Perguntas frequentes

Perguntas frequentes

Dá para reidratar um dataset de IDs de tweet com a Sorsa?

Dá. O endpoint em lote aceita até 100 IDs de tweet por requisição e devolve o conteúdo completo do tweet com os perfis dos autores. Ele substitui direto as ferramentas antigas de hidratação que dependiam da API oficial, e precisa apenas de uma chave de API, sem conta de desenvolvedor e sem OAuth.

A Sorsa cobre tweets antigos e o arquivo completo?

Cobre. A busca no arquivo completo alcança tweets públicos desde março de 2006, com os operadores avançados padrão para contas, intervalos de data, idiomas, frases e hashtags.

Preciso de conta de desenvolvedor do X (Twitter) ou de OAuth?

Não. O acesso é uma chave de API enviada num cabeçalho de requisição. Não há fila de solicitação, espera por aprovação nem fluxo de OAuth.

Os dados servem para o IRB ou para um comitê de ética?

A Sorsa é somente leitura e devolve apenas dados públicos. Não há ações de escrita nem atuação em nome de uma conta, o que deixa a coleta fácil de descrever. Fornecemos uma carta de uso de dados e conformidade para submissões ao IRB e a comitês de ética, se você pedir.

Vocês oferecem desconto acadêmico ou acesso gratuito?

Sim. Damos acesso grátis ou com desconto para pesquisa acadêmica não comercial verificada. Escreva para contacts@sorsa.io do seu e-mail institucional com uma descrição curta do projeto e do uso pretendido dos dados, e nós avaliamos.

A reidratação devolve tweets apagados ou protegidos?

Não. Como em qualquer reidratação, só voltam os tweets que continuam públicos. Tweets apagados ou tornados privados depois da coleta original não podem ser recuperados, o que é esperado e igual em todos os métodos.

A Sorsa pode postar tweets ou operar contas para um estudo?

Não. A Sorsa é estritamente somente leitura e cobre apenas o X (Twitter). Ela não posta, não responde, não segue e não faz nenhuma ação de escrita.

Comece a sua pesquisa

Busca no arquivo completo do X (Twitter) e reidratação por ID de tweet com orçamento fixo, compatível com verba de pesquisa. Somente leitura, dados públicos, uma chave de API. Suas primeiras 100 requisições são grátis: sem cartão e sem prazo de validade.