如何把推文导出为 CSV
选择来源
选一个账号(可选日期范围)、一次搜索(关键词、话题标签、搜索语法),或者一串帖子链接。
预览帖子
最新 20 条帖子立即显示,附带浏览量、点赞、转帖、回复、引用、书签、媒体和标签。可以按任意列排序。
下载
存成 CSV 可用于任何工具,Excel 适合表格,JSON 适合代码。要导出全部帖子,请用免费 API 密钥;估算会先告诉你准确的费用。
导出内容:每一列的说明
帖子
tweet_idurlcreated_atUTClangtype帖子、回复、引用或转帖in_reply_to_usernameconversation_id
互动
viewslikesrepostsrepliesquotesbookmarks
以导出那一刻的数据为准。
作者
author_usernameauthor_nameauthor_followers以导出时为准
内容和标签
texthashtagsmentionslinksmedia_typesmedia_urlsmade_with_aipaid_partnershipis_replies_limited
浏览量和书签是大多数导出工具会漏掉的两列,却往往最有用:浏览量反映触达,书签反映人们觉得值得留存的内容。标签列显示 X 自己对 AI 内容和赞助帖子的标注,其他导出工具都没有。
在 Excel 和 Google Sheets 里都能正常打开的文件
大多数推文导出文件一放进表格就出问题。这个工具专门避开了三个经典问题:
长 ID 保持准确。
帖子 ID 有 19 位数字。Excel 会把这么长的数字四舍五入,所以 ID 以文本形式保存,绝不会变成 1.23457E+18。
表情符号和其他文字不乱码。
CSV 文件采用带 BOM 的 UTF-8 编码,所以 Excel 能正确读取表情符号以及西里尔文、阿拉伯文或日文。
不会被当成公式。
以 =、+、− 或 @ 开头的单元格都会被转义,所以帖子正文永远不会被当作表格公式执行。
导出一个账号、一次搜索或一串帖子
账号
- 一个主页的最新 20 条帖子,按时间从新到旧。
- 加上日期范围就能导出某个时间段:此时会切换到带
from:以及since:或until:的 X 搜索,而且能比主页时间线回溯得更远。 - 开关回复、转帖和只看带媒体的帖子,调整数据集的范围。
搜索
- 最新 20 条匹配的帖子,按时间从新到旧。
- X 搜索能找到的都行:关键词、话题标签、提及、短语、语言,以及
min_faves这样的互动筛选条件。 - 先用高级搜索生成器拼出复杂查询,再粘贴到这里。
帖子链接
- 粘贴最多 20 个链接或 ID,比如来自报告、活动追踪表或表格,每条帖子得到一行当前数据。
- 已经打不开的链接会被标出来。
最早能导出到什么时候?
X 上账号的主页时间线只能回溯到一定程度,大约是最近几千条帖子。更早的帖子请用日期范围:导出会改走 X 搜索,一次一个时间段,能回溯得远得多。任何工具都受两个限制:
- 已删除的帖子就没了,受保护账号的帖子也不公开。
- 搜索不是包罗万象的存档。X 搜索只返回它收录的内容,所以非常老或互动很少的帖子可能搜不到。某个时间段的准确数量也可能和账号总数对不上。
如果你想要自己完整的历史记录,包括多年前的帖子,请在 X 设置里下载你的 X 存档。那只覆盖你自己的账号;这个工具覆盖任意账号的公开帖子。
不用爬虫、插件或登录就能导出推文
把推文弄进表格,常见的有三种方式,各有各的问题:
| 浏览器插件 | 爬虫平台 | 这个导出工具 | |
|---|---|---|---|
| 需要你的 X 登录 | 需要,在你已登录的浏览器里运行 | 有时需要 | 不需要 |
| 需要安装东西 | 需要 | 要注册账号并配置 | 不需要 |
| 即时预览 | 看产品 | 不能,先运行再下载 | 能,20 行 |
| 浏览量和书签 | 部分有 | 部分有 | 有 |
| AI 和赞助标签 | 没有 | 很少有 | 有 |
| 事先显示完整导出的费用 | 不显示 | 按次运行计价 | 显示,按请求计算 |
许多研究人员依赖的免费 Google Sheets 插件 TAGS,在 2023 年 X 取消免费 API 访问后就失效了。这个页面是小规模导出的直接替代方案,不用任何配置;大规模导出则交给 Sorsa API。
用 API 导出成千上万条推文
预览只到 20 行。Sorsa API 能不设上限地返回同样的数据行:
- /user-tweets 和 /search-tweets 每次请求 20 条帖子,附带下一页的 cursor;
- /tweet-info-bulk 每次请求 100 条帖子。
| 导出规模 | 请求次数 | Pro 套餐费用 |
|---|---|---|
| 1,000 条帖子 | 50 | 约 $0.10 |
| 3,200 条帖子 | 160 | 约 $0.32 |
| 2 万条帖子 | 1,000 | 约 $2 |
- 一个 API 密钥,无需应用审核,大约 3 分钟就能配好
- 和这个页面同样的列,以 JSON 返回
- 所有套餐统一每秒 20 次请求
- 注册即送100 次免费请求:最多 2,000 条帖子,无需绑卡
import csv, requests H = {"ApiKey": "YOUR_API_KEY"} body, rows = {"username": "nasa", "with_replies": False}, [] while True: page = requests.post("https://api.sorsa.io/v3/user-tweets", headers=H, json=body).json() rows += page.get("tweets", []) if not page.get("next_cursor") or len(rows) >= 1000: break body["next_cursor"] = page["next_cursor"] with open("tweets.csv", "w", newline="", encoding="utf-8-sig") as f: w = csv.writer(f) w.writerow(["id", "created_at", "text", "views", "likes"]) for t in rows: w.writerow([t["id"], t["created_at"], t["full_text"], t.get("view_count"), t.get("likes_count")])
相关工具
如何下载一个用户的全部推文常见问题
怎么把推文导出为 CSV?
在上方输入一个账号、一次搜索或一串帖子链接,预览帖子,然后点 CSV。文件里每条帖子都有正文、日期、作者、浏览量、点赞、转帖、回复、引用、书签、媒体链接和标签。
能导出任意账号的推文,而不只是我自己的吗?
能。任何公开的 X 账号都可以,无需登录。受保护账号无法导出,因为它们的帖子是私密的。
免费吗?
免费。每次导出最新 20 条帖子,来源可以是一个账号、一次搜索或最多 20 个链接,每天 5 次免费导出。更大的导出用免费 API 密钥:前 100 次请求最多覆盖 2,000 条帖子。
能下载一个用户的全部推文吗?
在这里,你可以拿到一个账号最新的 20 条帖子,或者用日期范围选定任意更早时间段的最新 20 条,走的是 X 搜索。已删除的帖子和 X 不再收录的帖子无法找回。要拿到你自己的完整历史,请在 X 设置里下载你的 X 存档。
能导出某个话题标签或搜索的推文吗?
能。用“搜索”标签页:关键词、话题标签、短语和 X 搜索语法都能用,还可以选日期范围。
导出包含浏览量和书签吗?
包含。浏览量、点赞、转帖、回复、引用和书签都在里面,以导出那一刻的数据为准。
文件能在 Excel 或 Google Sheets 里打开吗?
能。Excel 下载 .xlsx,其他表格下载 CSV 即可。ID 以文本保存,不会被四舍五入;CSV 是带 BOM 的 UTF-8,表情符号和非拉丁文字都能正常显示。
能导出一个账号的点赞或书签吗?
不能。在 X 上,账号点赞过的帖子列表和书签都是私密的,任何基于公开数据的工具都无法导出。
这是推特爬虫吗?
这是基于 Sorsa API 的导出工具。你不需要在自己这边跑爬虫、浏览器插件或自动化脚本,你的 X 账号也完全不会参与。
这是 TAGS 的替代品吗?
是的,适合不想配置的小规模导出。TAGS 在 2023 年 X 取消免费 API 访问后就失效了。要持续把数据收集到表格里,Sorsa API 以每次请求 20 条帖子的方式返回同样的数据。