API de X (Twitter) para investigación académica

Cuando X cerró su Academic Research Track gratuito en 2023, desapareció el archivo completo y el acceso de alto volumen que sostuvo casi dos décadas de investigación publicada sobre Twitter. Sorsa API devuelve ese acceso, gratis o con descuento para investigadores no comerciales verificados.

  • Búsqueda de archivo completo que se remonta a marzo de 2006, con los operadores avanzados en los que se apoyaban los investigadores: from:, to:, since:, until:, lang:, frases exactas y hashtags.
  • Hidrata o rehidrata hasta 100 IDs de tweet por solicitud, un reemplazo directo de los flujos ya muertos de Hydrator y de twarc sobre la API oficial.
  • Acceso de solo lectura a datos públicos con una sola clave API : sin aprobación de cuenta de desarrollador, sin OAuth y sin contrato empresarial de $42,000.

O simplemente escríbenos: contacts@sorsa.io


El hueco

Lo que perdieron los investigadores en 2023

Durante diecisiete años la API de Twitter fue la fuente de datos dominante en ciencia política, salud pública, ciencias sociales computacionales, estudios de comunicación y lingüística, y sostuvo trabajos sobre elecciones, desinformación y comunicación de crisis. El Academic Research Track daba a los investigadores calificados búsqueda de archivo completo hasta 2006 y unos 10 millones de tweets al mes. Anunciado en febrero de 2023, el acceso gratuito a la API se cortó esa primavera, y a mediados de 2023 los endpoints académicos desaparecieron por completo. Los planes de reemplazo ofrecían poco para investigación: un plan básico de $100 sin acceso histórico, o un contrato empresarial que arrancaba cerca de $42,000 al mes. Más de cien estudios se cancelaron o se suspendieron. Para ver a fondo cómo acceder a tweets viejos, consulta nuestra guía sobre datos históricos de Twitter.


Capacidades

Todo lo que necesitas para armar un dataset de Twitter

Diferencial principal

Rehidratación por ID de tweet para datasets compartidos

Los datasets de investigación compartidos se distribuyen como listas de IDs de tweet para respetar los términos de X. Rehidratarlos antes exigía la API oficial mediante herramientas como DocNow Hydrator o twarc, y las dos se rompieron cuando terminó el acceso gratuito y el académico. El endpoint por lotes de Sorsa acepta hasta 100 IDs de tweet por solicitud y devuelve el JSON completo del tweet con los perfiles de autor incluidos, sin cuenta de desarrollador y sin OAuth. Cada tweet trae además view_count y bookmark_count , métricas de engagement que la API oficial no expone para tweets de terceros.

1,000,000 de IDs de tweet en Sorsa, toda la cuota mensual del plan Starter de $49
$49
10,000 solicitudes por lotes · 100 IDs cada una
El mismo volumen en la API oficial de X, cobrado por lectura de post
~$5,000
precio por lectura de post

Búsqueda de archivo completo que se remonta a 2006

Busca en todo el archivo público con la sintaxis de búsqueda avanzadade Twitter: from: y to: para recolección por cuenta, since: y until: para ventanas de fechas, lang: para filtrar por idioma, además de frases exactas y hashtags. Arma datasets longitudinales, ventanas de eventos y corpus de palabras clave como permitía el Academic Track. Consulta nuestra guía de desarrollo sobre búsqueda de tweets por API, o cómo descargar todos los tweets de una cuenta.

Datasets reproducibles y compartibles

Cada respuesta incluye IDs estables de tweet y de usuario, así que puedes publicar una lista de IDs conforme a los términos junto a tu artículo y dejar que otros reproduzcan tu recolección. La salida es JSON limpio que entra directo en R, pandas o tu notebook, listo para análisis de sentimiento y otros pipelines posteriores.

Acceso simple y compatible con ética

Una clave API en una cabecera de solicitud, de solo lectura y solo con datos públicos. No hay nada que publicar ni ninguna cuenta en cuyo nombre actuar, lo que hace fácil describir la recolección ante un IRB o un comité de ética. Sin cola de solicitudes y sin espera de aprobación.


Cómo se compara el acceso

Academic Track, API oficial de X y Sorsa

Academic Research Trackantes de 2023API oficial de X2026, pago por usoSorsatarifa plana por solicitud
Búsqueda de archivo completoSí, hasta 2006Solo en el plan enterpriseSí, hasta 2006
Volumen mensual~10 millones de tweetsMedido por lectura de postPlanes fijos, cualquier volumen
Proceso de aprobaciónSolicitud y revisión, semanasAprobación de cuenta de desarrolladorNinguno, clave API al instante
Para empezar gratisRequiere solicitudNinguna100 solicitudes gratis
Método de autenticaciónOAuth y bearer tokenOAuth 2.0Una sola cabecera con la clave API
Costo por 1 millón de tweetsGratis, si te aprobaban~$5,000Gratis o con descuento para académicos
Métricas de engagementLikes, retweets, respuestasLimitadas para tweets de tercerosLikes, retweets, respuestas + view_count y bookmark_count

Experiencia de desarrollo

Rehidrata un dataset en pocas líneas

Manda hasta 100 IDs de tweet por llamada, recorre tu dataset en lotes de 100 y escribe los resultados en .ndjson para analizarlos. La configuración completa está en la documentación de datos históricos.

Python
import requests

ids = ["1266876474440761346", "1266868259925737474"]  # up to 100 per request

res = requests.post(
    "https://api.sorsa.io/v3/tweet-info-bulk",
    headers={"ApiKey": "YOUR_API_KEY"},
    json={"tweet_links": ids},
)

for tweet in res.json()["tweets"]:
    print(tweet["full_text"], tweet["user"]["username"])

Para investigadores

Acceso académico gratuito y con descuento

Quién califica: profesorado, posdoctorados, estudiantes de doctorado y de maestría, e investigadores de la sociedad civil en proyectos no comerciales: cuentan las tesis de maestría, las tesis doctorales y los estudios financiados del profesorado. Qué recibes: una cuota gratuita de solicitudes para estudios piloto, o un descuento permanente en los planes de pago para recolecciones más grandes. respondemos en dos días hábiles.

Para solicitarlo, escribe a contacts@sorsa.io desde tu correo institucional (.edu o el dominio de tu universidad), o usa el formulario de abajo: describe tu pregunta de investigación y cómo usarás los datos, y confirma que el trabajo es no comercial. Entregamos una carta de uso de datos y cumplimiento para presentaciones ante IRB y comités de ética si la pides. Los planes de tarifa plana por solicitud también se facturan como una partida fija y predecible para propuestas de financiamiento, a diferencia del cobro por uso de la API oficial.

Solicita acceso académico

¿Tu trabajo va más allá de la investigación académica?

Si tu trabajo es comercial, o simplemente quieres acceso estándar a la API sin solicitar nada, tenemos planes de tarifa plana por solicitud para cualquier volumen. El desglose completo está en la página de precios.

Ver precios

Escenario representativo

Cómo usan Sorsa los investigadores

3.2 millones
de IDs de tweet = 32,000 solicitudes por lotes, bastante menos de un mes de Pro

Imagina un grupo de comunicación que estudia el discurso electoral y tiene un dataset de 3.2 millones de IDs de tweet compartido por un laboratorio aliado. Después del cierre del Academic Track, un pipeline con twarc como el suyo solo devolvería errores de autenticación. En el endpoint por lotes de Sorsa, esos 3.2 millones de IDs son 32,000 solicitudes por lotes de 100, cerca de un tercio de un solo mes de Pro, y aproximadamente 30 minutos reales a 20 solicitudes por segundo. La rehidratación se retoma sin contrato empresarial y sin cambiar la metodología de recolección.


Preguntas frecuentes

Preguntas frecuentes

¿Puedo rehidratar un dataset de IDs de tweet con Sorsa?

Sí. El endpoint por lotes acepta hasta 100 IDs de tweet por solicitud y devuelve el contenido completo del tweet con los perfiles de autor. Funciona como reemplazo directo de las herramientas de hidratación antiguas que dependían de la API oficial, y solo necesita una clave API, sin cuenta de desarrollador y sin OAuth.

¿Sorsa cubre tweets viejos y el archivo completo?

Sí. La búsqueda de archivo completo llega a tweets públicos hasta marzo de 2006, con los operadores avanzados estándar para cuentas, rangos de fechas, idiomas, frases y hashtags.

¿Necesito una cuenta de desarrollador de X (Twitter) u OAuth?

No. El acceso es una sola clave API que va en una cabecera de solicitud. No hay cola de solicitudes, ni espera de aprobación, ni flujo de OAuth.

¿Los datos sirven para una revisión de IRB o de ética?

Sorsa es de solo lectura y devuelve únicamente datos públicos. No hay acciones de escritura ni actuación en nombre de una cuenta, lo que hace fácil describir la recolección. Entregamos una carta de uso de datos y cumplimiento para presentaciones ante IRB y comités de ética si la pides.

¿Ofrecen descuentos académicos o acceso gratuito?

Sí. Damos acceso gratuito o con descuento a la investigación académica no comercial verificada. Escribe a contacts@sorsa.io desde tu correo institucional con una descripción breve de tu proyecto y del uso previsto de los datos, y lo revisamos.

¿La rehidratación devuelve tweets borrados o protegidos?

No. Como en cualquier rehidratación, solo se devuelven los tweets que siguen públicos. Los tweets borrados o vueltos privados después de la recolección original no se pueden recuperar, algo esperado e igual en todos los métodos.

¿Sorsa puede publicar tweets o manejar cuentas para mi estudio?

No. Sorsa es estrictamente de solo lectura y cubre únicamente X (Twitter). No publica, no responde, no sigue cuentas ni hace ninguna acción de escritura.

Empieza tu investigación

Búsqueda de archivo completo de X (Twitter) y rehidratación por ID de tweet con un presupuesto fijo y compatible con becas. De solo lectura, datos públicos y una sola clave API. Tus primeras 100 solicitudes son gratis: sin tarjeta y sin vencimiento.