Twitter Profile Scraper
X 账号资料通过用户名、显示名称、简介、主页地址、图片、状态标记和公开计数识别一个公开账号。把这些信号与明确的采集时间结合,可用于筛选账号、完善名录和比较资料变化。
主要特性
- 从用户名解析账号资料在同一次采集中解析一个或多个公开 X 用户名,每个值开头的 @ 均可保留或省略。
- 身份、简介与视觉素材使用账号 ID、用户名、显示名称、主页地址、简介、地点、头像、封面和创建时间建立资料记录。
- 账号状态与受众规模将认证、隐私、私信、置顶帖子和自动化信号,与关注者、关注中、帖子、媒体和点赞计数放在同一记录中。
- 可比较的资料快照同时保留提交用户名、账号创建日期和 collected_at,使重复查询可以按时间追溯。
参数
| 参数 | 必填 | 描述 |
|---|---|---|
usernames | 必填 | 必填的公开 X 用户名列表。每个值都可以带或不带开头的 @。 |
如何使用
先整理账号名单,再通过统一的异步任务与游标结果流程解析资料。
- 规范化需要检查的公开 X 用户名,开头的 @ 可选。
- 向 /v1/x/profiles POST usernames 数组,并保留返回的 task_id。
- 轮询 /v1/tasks/{task_id},直到任务进入 succeeded 或 failed。
- 任务成功后保存 data.results.items;has_more 仍为 true 时通过 next_cursor 继续读取。
curl -X POST "https://api.socq.ai/v1/x/profiles" \
-H "Authorization: Bearer $SOCQ_API_KEY" \
-H "Content-Type: application/json" \
-d '{"usernames":["nasa","@OpenAI"]}'
# 轮询 GET /v1/tasks/{task_id}
# 读取 data.results.items,并在 has_more 为 true 时继续使用 next_cursor最佳使用场景
- 核验创作者与合作账号: 在加入候选名单前,比较一组已知账号的身份、简介、认证状态和公开受众计数。
- 补全账号名录: 为已有 CRM 或合作伙伴记录补充主页地址、显示名称、简介、图片、地点和公开计数。
- 比较资料变化: 对同一批账号 ID 重复查询,并使用 collected_at 比较简介、状态信号和受众计数。
使用建议
- 提交大型账号名单前,去掉开头的 @,并按不区分大小写的用户名去重。
- 把 id 作为稳定账号主键,同时保留 username 和 extra.input_username 用于展示与来源匹配。
- 比较关注者、帖子或媒体计数时,以 collected_at 为时间锚点,不把计数当作固定值。
- 允许可选图片和账号信号为空,避免公开资料不完整时破坏下游记录。
相关 API
需要其他类型的 X 公开数据时,可以使用以下 API。
- Twitter Tweet Scraper API — 从 x.com 或 twitter.com status URL 获取公开帖子正文、作者、互动、媒体、标签、提及和会话关系。
- Twitter User Tweets Scraper API — 按 username 采集近期公开帖子、作者、媒体、标签、提及和互动指标,并排除回复。
- Twitter Search API — 按搜索表达式查找公开帖子,并支持 latest 或 top 排序和结果数量上限。