

输入问题或链接,无需代码即可提取Perplexity AI的完整回答及引用来源,以HTML格式导出,适用于学术研究、事实核查与内容分析。
抓取 Perplexity 回答页面渲染完成后的 HTML,并统一打开标准化后的 Perplexity 查询地址。
支持两种入参:
{"url": "https://www.perplexity.ai/?q=apple"}{"search_terms": "apple"}如果传入的是 url,Worker 会先从 URL 中提取查询词,然后仍然打开 https://www.perplexity.ai/?q=<search_terms>。
| 字段 | 必填 | 说明 |
|---|---|---|
url | 否 | 包含 q 查询参数的 Perplexity URL。 |
search_terms | 否 | 直接用于 Perplexity 查询的搜索词。 |
flow_retry_num | 否 | 整个流程的重试次数,不传时默认 3。 |
capture_screenshot | 否 | 是否捕获最终页面截图,默认 true;传 false 时跳过截图并让 screenshot 为空,以减少耗时。 |
url 和 search_terms 至少传一个。
| 字段 | 说明 |
|---|---|
url | 实际打开的标准化 Perplexity URL。 |
code | 1 表示成功,0 表示失败。 |
has_sources_data | true 表示当前页面存在 Sources 按钮对应数据,false 表示不存在。 |
Content-Encoding | HTTP 风格压缩方式,当前为 gzip。 |
content_encoding | 压缩方式,当前为 gzip。 |
compressed_html | 经过 gzip 压缩并再进行 base64 编码后的 HTML。 |
html_size | 压缩前、最小化后的 HTML 的 UTF-8 字节数。 |
compressed_size | base64 编码前的 gzip 二进制字节数。 |
response_raw | Perplexity 在解析或转换前返回的原始 SSE 响应体。 |
screenshot | 流程结束后最终可视页面状态的 PNG 截图,经过 base64 编码。 |
error | 失败时的错误信息。 |
error_code | 失败错误码,例如 400、500、CF_DETECTED、ANSWER_TIMEOUT、SOURCES_FAILED。 |
https://www.perplexity.ai/?q=<search_terms>。flow_retry_num 次,不传时默认 3。Sources,并在出现时关闭后续弹窗。response_raw。capture_screenshot 不为 false 时,捕获流程结束后的最终可视页面 PNG 截图,并写入 screenshot。探索商店中更多热门采集工具
by scraper
从公开的 TikTok 视频中提取评论,并将对话转换为结构化数据。 粘贴一个或多个 TikTok 视频 URL,选择要收集的评论和回复数量,即可获取评论文本、用户名、点赞数、时间戳、回复数以及相关公开数据。 可将结果用于社交聆听、情感分析、营销活动研究、产品反馈、趋势分析或自动化数据工作流。
by scraper
从公开可访问的 Instagram 内容中下载照片、视频、Reels 和 Stories。 粘贴 Instagram 帖子或 Reel URL,或输入公开用户名,即可批量收集媒体。无需登录 Instagram 账户,即可获取直接媒体 URL 和实用的帖子元数据。 使用 CoreClaw 归档你自己的内容、管理已获授权的社交媒体素材、收集公开媒体用于研究,或将 Instagram 媒体提取连接到自动化工作流。
by scraper
无需逐个浏览创业公司资料,即可从 TrustMRR 提取创业公司的营收与增长数据。 以结构化数据形式采集 MRR、历史总营收、月度增长率、分类、排行榜排名、收购挂牌信息、要价、营收倍数、支付服务商和创始人信息。 可按分类、MRR 或收购状态筛选创业公司,并将结果导出,用于市场研究、竞争对手分析、销售线索挖掘和创业公司收购研究。
by scraper
下载公开的 MEGA 文件和文件夹,无需反复使用浏览器变通方法。将公开的 mega.nz链接粘贴到 CoreClaw 中并运行 Worker,即可获取文件,或将完整文件夹打包为 ZIP。 如果你想在开始完整下载前验证链接并查看文件大小,请使用“仅检查”模式。