

使用关键词、个人资料、话题标签、高级搜索查询和自定义筛选条件从 X 和 Twitter 提取推文。 按账户、日期、语言、互动数据、媒体类型、认证状态或地理条件进行搜索,并采集推文文本、作者数据、点赞、回复、转发、引用、时间戳、媒体及其他公开元数据。 使用 CoreClaw 进行社交聆听、情感分析、市场研究、品牌监控、内容研究和大规模 X 数据工作流。
Twitter 抓取器可帮助你采集 X 和 Twitter 上公开可用的帖子和个人资料信息,并将结果转换为结构化数据。
无需手动搜索 X 并逐条复制推文,只需定义所需的受众、主题、账户、话题标签或搜索条件,然后让 CoreClaw 处理结果。
你可以用它来:
跟踪围绕品牌、产品、公司、竞争对手、行业和事件的公开讨论。
大规模采集推文文本,并将其用于情感分析、主题分类或语言分析工作流。
搜索品牌名称、产品名称、URL、话题标签和账户提及,以监控公开讨论。
跟踪竞争对手账户和相关关键词,研究其传播内容、产品发布、受众反应和互动表现。
分析围绕市场、行业、技术和新兴趋势的讨论。
按关键词、话题标签、作者或媒体类型查找高互动推文,了解哪些内容更能引起受众共鸣。
分析指定 X 账户的帖子,以及关注者、认证信息和互动指标。
为获准开展的传播、公共讨论和在线行为研究构建结构化公开推文数据集。
| 🆔 推文 ID | 🔗 推文 URL |
| 📝 推文文本 | 🌐 语言 |
| 🕒 创建时间 | ❤️ 点赞数量 |
| 🔁 转发数量 | 💬 回复数量 |
| 💭 引用数量 | 🔖 书签数量 |
| ↩️ 回复状态 | 🔁 转发状态 |
| 💬 引用状态 | 📍 地点数据 |
| 🖼️ 图片 | 🎬 视频 |
| 📰 文章数据 | 📊 公开推文元数据 |
可用字段取决于推文本身以及 X 公开提供的信息。
可用的作者字段包括:
| 👤 用户名 | 📝 显示名称 |
| 🆔 用户 ID | 🔗 个人资料 URL |
| ✅ 认证状态 | 🔵 蓝标认证 |
| 🏷️ 认证类型 | 🖼️ 个人资料图片 |
| 👥 关注者 | ➡️ 正在关注 |
这样可以将推文内容与有用的公开作者信息结合起来进行分析。
可用的搜索排序方式包括:
LatestTopLatest + Top当时效性很重要时,使用 Latest。
当互动度和相关性更重要时,使用 Top。
当你希望获得更广泛的覆盖范围,并准备对重叠结果进行去重时,使用 Latest + Top。
所引用的 Apify 实现针对大规模搜索进行了优化,目前存在若干特定限制。
它要求每个查询至少返回约 50 条推文。
它不适用于:
CoreClaw 的确切限制取决于当前 Worker 的实现。
If your workflow requires single 推文 URLs or complete conversation threads, use a dedicated Tweet or conversation extraction Worker when available.
X 控制其自身的搜索结果。
某些推文可能因以下原因不会出现:
如果 X 本身未通过相应搜索公开某些内容,抓取器也无法可靠返回这些内容。
对于重要研究,建议在运行大规模采集任务前直接在 X 上测试查询。
CoreClaw Twitter 抓取器也可以集成到自动化工作流中。
可将推文数据连接到:
Start with a topic, account, hashtag, mention, or X search rather than manually collecting 推文 URLs.
组合作者、日期、语言、媒体、认证、地点和互动条件。
同时采集推文文本、互动指标和公开作者信息。
使用点赞、转发、回复、媒体或认证筛选条件减少无关结果。
将 X 数据导入 CSV、JSON、电子表格、数据库或分析工作流。
通过 CoreClaw 运行搜索,同时保留 API 访问能力以支持自动化工作流。
可以。添加关键词或 Twitter 高级搜索查询。
可以。使用 Twitter 用户名或类似 from:username 的查询。
可以。添加 #AI 等话题标签,或将其与语言及其他搜索运算符组合。
可以。可通过高级搜索语法或支持的日期字段应用日期筛选。
可以。设置最低点赞、转发和回复数量,或在支持时按 Top 排序。
可以。在支持时可将结果限制为已认证用户。
探索商店中更多热门采集工具
by scraper
以结构化工作流查看 Instagram 账户的粉丝列表,并移除指定账户。 连接已授权的 Instagram 会话,加载粉丝列表,查看账户详情,并提供需要移除的粉丝用户名、个人资料 URL 或 Instagram ID。 使用 CoreClaw 管理粉丝清理,无需自行构建和维护浏览器自动化脚本。
by scraper
从 Facebook 个人资料中提取帖子和公开互动数据。 添加一个或多个 Facebook 个人资料 URL,连接已授权的 Facebook 会话,并采集帖子文本、图片、视频、评论、反应、分享、作者详情、时间戳、链接及其他可用的帖子元数据。 使用 CoreClaw 进行社交聆听、内容研究、情感分析、受众研究、归档和自动化社交数据工作流。
by scraper
按关键词、地点、薪资、半径或公司名称搜索全球职位列表,并将结果转换为结构化职位数据。 CoreClaw Jooble Jobs API 从 Jooble 聚合的职位数据源中返回职位名称、公司、地点、薪资、雇佣类型、来源网站、发布日期、职位描述和直接申请链接。 可将这些数据用于招聘网站、招聘研究、薪资分析、招聘情报、潜在客户开发以及自动化职位提醒工作流。
by scraper
从公开的 Dailymotion 视频中提取可下载的视频链接和元数据。 粘贴一个或多个 Dailymotion 视频 URL,即可采集标题、时长、缩略图、视频 ID、多种可用画质选项,以及首选下载 URL,并以结构化格式返回。 使用 CoreClaw 可进行视频归档、媒体研究、内容监控、画质分析和自动化视频工作流。