Twitter User Tweets Scraper
X 账号时间线是一组归属于同一用户名的近期公开帖子,记录发布时间、正文、媒体、作者背景与可见互动。将指定账号的时间线放在一起观察,可以判断发布节奏、反复出现的主题和内容组合变化。
主要特性
- 一次整理多个账号时间线提交一个或多个公开 X 用户名,开头的 @ 可保留也可省略,在同一任务中采集每个账号的近期帖子。
- 聚焦近期发布内容采集过程固定排除回复,使时间线集中呈现账号近期的其他公开发帖活动。
- 每个账号单独计算上限results_limit 分别应用于每个用户名,默认 20,可设置为 20 至 2,000 之间的 20 倍数。
- 适合账号分析的帖子记录每条帖子可包含正文、语言、作者资料、可见互动、媒体、实体、时间和会话关系。
- 保留账号与采集来源extra.input_username 标记提交的账号,collected_at 则记录这次时间线快照的采集时间。
参数
| 参数 | 必填 | 描述 |
|---|---|---|
usernames | 必填 | 必填的公开 X 用户名列表。每个值都可以带或不带开头的 @。 |
results_limit | 可选 | 分别应用于每个用户名的可选结果上限。默认 20,可填写 20 至 2,000 之间且为 20 倍数的值。 |
如何使用
先确定要观察的账号,再为它们设置一致的采集深度,即可把近期时间线整理成便于比较的记录。
- 添加一个或多个公开 X 用户名,开头的 @ 可选。
- 为每个账号设置 20 至 2,000 之间且为 20 倍数的 results_limit。
- 向 /v1/x/user-posts POST 请求,并轮询 /v1/tasks/{task_id} 直到任务完成。
- 逐页追加 data.results.items,在还有后续结果时使用 next_cursor。
curl -X POST "https://api.socq.ai/v1/x/user-posts" \
-H "Authorization: Bearer $SOCQ_API_KEY" \
-H "Content-Type: application/json" \
-d '{"usernames":["nasa","OpenAI"],"results_limit":40}'
# 轮询 GET /v1/tasks/{task_id}
# 读取 data.results.items,并在 has_more 为 true 时继续使用 next_cursor最佳使用场景
- 维护账号观察名单: 通过 extra.input_username 按来源整理近期帖子,持续查看选定品牌、创作者、竞品或公共机构的动态。
- 比较账号发布节奏: 利用 created_at 统计各账号的发帖频率,并观察发布时间、媒体使用和常见主题的变化。
- 建立近期帖子语料库: 将正文、作者、媒体、实体与互动字段组合为带账号归属的数据集,用于分类或内容复盘。
使用建议
- 提交前去掉用户名开头的 @,并忽略大小写进行去重。
- 比较多个账号时使用相同的 results_limit,并确保它是合法的 20 倍数。
- 把 results_limit 视为每个账号的上限,因为实际可返回的近期帖子可能更少。
- 周期采集时先按帖子 id 去重,再把新记录加入已有时间线数据集。
- 用 created_at 分析发布时间顺序,用 collected_at 判断采集快照的新旧。
相关 API
需要其他类型的 X 公开数据时,可以使用以下 API。
- Twitter Tweet Scraper API — 从 x.com 或 twitter.com status URL 获取公开帖子正文、作者、互动、媒体、标签、提及和会话关系。
- Twitter Profile Scraper API — 按 username 获取公开账号身份、简介、头像、封面、账号状态和可见受众统计。
- Twitter Search API — 按搜索表达式查找公开帖子,并支持 latest 或 top 排序和结果数量上限。