

通过 Instagram URL 批量提取公开 Reel 数据,包括作者用户名、标题、标签、评论数、点赞数、浏览量、播放量、互动数等数据。支持导出数据、API 调用或与第三方工具集成。
从任意公开 Instagram 用户主页 URL 采集 Reels(可选附带普通 Posts),输出结构化记录,支持 UTC 起始日期筛选、去重合并与流式推送。
每条 Reel(或 Post)输出一条记录。成功记录的 content_type 固定为 Reels 或 Posts。
| 字段 | 类型 | 说明 |
|---|---|---|
url | link | 规范的 Instagram 媒体 URL(Reels 为 /reel/<shortcode>/,Posts 为 /p/<shortcode>/) |
content_type | string | Reels 或 Posts |
owner | object | 作者账号详情(见下) |
description | string | 媒体文案正文 |
hashtags | array | 从文案中提取的标签 |
num_comments | number | 评论数 |
date_posted | number | Instagram 发布时间戳(Unix 秒) |
likes_count | number | 点赞数 |
video_play_count | number | 视频播放 / 观看数(取 Instagram 暴露的第一个计数器) |
top_comments | object | 第一条预览评论(见下) |
post_id | string | Instagram 媒体主键(PK) |
thumbnail | image | 主媒体缩略图 URL |
shortcode | string | Instagram 媒体 shortcode |
content_id | string | 兼容用内容标识(与 shortcode 相同) |
product_type | string | Instagram 产品类型(如 clips、feed) |
coauthor_producers | array | Instagram 返回的合作者记录 |
tagged_users | array | 媒体中被标记的用户(见下) |
duration | string | 主视频时长 |
video_url | link | 主视频 URL |
audio_url | link | Instagram 音频页 URL(暴露音频资源时) |
media | array | 帖子内归一化的图片与视频项(见下) |
alt_text | string | 媒体无障碍文案 |
photos_number | number | 图片项数量 |
dimensions_height | number | 主媒体高度 |
dimensions_width | number | 主媒体宽度 |
is_paid_partnership | boolean | 是否为付费合作 |
error | string | 错误信息——仅出现在终止失败行 |
error_code | string | 机读错误码——仅出现在终止失败行 |
owner 对象字段:id、username、full_name、profile_url、profile_picture、is_verified、is_private、followers_count、following_count、posts_count。当媒体作者与请求的主页一致时,主页级计数(followers_count、following_count、posts_count)从主页元数据填充。
top_comments 对象字段:comments(正文)、user_commenting(作者用户名)、likes_count、profile_picture。无预览评论时为空对象。
tagged_users 项字段:full_name、id、is_verified、profile_pic_url、username。
media 项字段:type(image 或 video)、url、thumbnail、width、height。
hashtags、media、tagged_users、coauthor_producers)始终输出数组。top_comments 始终输出对象。error 和 error_code 的终止记录。每个任务接收一行主页 URL及其选项。url 字段是行数组(requestListSource),每个任务只处理一行。
| 字段 | 类型 | 必填 | 默认值 | 说明 |
|---|---|---|---|---|
url | URL | 是 | — | Instagram 用户主页 URL,例如 https://www.instagram.com/nasa/。不接受 Post、Reel、Hashtag 或 Explore URL。 |
include_posts | Boolean | 否 | false | 为 true 时,在 Reel 之外同时采集普通图片帖和轮播帖。 |
max_results | Integer | 否 | 100 | 当前主页 Reel 与 Post 合并后的最大成功结果数。非正数或非法值回退为默认值。 |
excluded_post_ids | String / Array | 否 | "" | 需要排除的 Instagram 媒体 PK 或 shortcode,可用英文逗号、换行分隔,或以数组提供。 |
start_date | String(日期) | 否 | "" | UTC 起始日期,包含当天。支持 DD/MM/YYYY、MM-DD-YYYY、YYYY-MM-DD、MM/DD/YYYY、YYYY/MM/DD。 |
url公开 Instagram 账号的主页 URL。仅接受 instagram.com、www.instagram.com 或 m.instagram.com 上的 http://、https:// 链接。路径必须是单段用户名——Instagram 保留路径(accounts、direct、explore、p、reel、reels、stories、tv)会被拒绝。两段路径在第二段为 reels 或 tagged 时也可接受(如 https://www.instagram.com/nasa/reels/)。
✅ 推荐:
❌ 不支持(会被拒绝):
include_posts默认关闭,即只采集 Reels。设为 true 可同时采集普通 Post(图片与轮播)。开启后,Reel 与 Post 候选项按发布时间倒序合并并按媒体 ID 去重,合并后的成功输出总数不超过 max_results。
max_results限制该主页返回的成功记录数,是每个主页的上限,不是全局上限。非正数或非整数值会静默回退为 100。
✅ 推荐:
excluded_post_ids跳过已采集过的媒体,按 Instagram 媒体 PK 或 shortcode 标识。接受英文逗号或换行分隔的字符串,或 JSON 数组。PK(数字)与 shortcode(如 Cabc123XYZ)两种形式都会匹配。
"excluded_post_ids": "3421567890123456789,Cabc123XYZ,Cdef456UVW"
start_date可选的 UTC 起始日期,包含当天。设置后,没有有效发布时间的媒体会被排除;当某一整页都早于起始日期时,分页会提前停止(见筛选与上限的行为规则)。
任一格式均可:
| 格式 | 示例 |
|---|---|
DD/MM/YYYY | 01/07/2026 |
MM-DD-YYYY | 07-01-2026 |
YYYY-MM-DD | 2026-07-01 |
MM/DD/YYYY | 07/01/2026 |
YYYY/MM/DD | 2026/07/01 |
每行是一条 Reel 或 Post。下表列出部分列,完整字段见 JSON 记录。
content_type | owner.username | shortcode | likes_count | video_play_count | video_url |
|---|---|---|---|---|---|
| Reels | nasa | Cabc123XYZ | 1284000 | 5210000 | https://...mp4 |
| Posts | nasa | Cdef456UVW | 96210 | — | — |
一条成功的 Reel 记录如下。每个键都是 schema 中的真实输出列,值使用占位标识符与保留域名。
终止失败行(主页加载失败或无匹配媒体时输出)保持相同结构,但只携带标识与错误字段:
标识与类型 —— url 是规范的媒体 URL(Reels 为 /reel/<shortcode>/,Posts 为 /p/<shortcode>/)。content_type 为 Reels 或 Posts。post_id 是 Instagram 媒体 PK;shortcode 与 content_id 均为 shortcode。product_type 是 Instagram 原始产品类型(如 clips、feed)。
作者(owner) —— id、username、full_name、profile_url、profile_picture、is_verified、is_private、followers_count、following_count、posts_count。当媒体作者与请求的主页一致时,主页级计数从主页元数据填充。
文案与可发现性 —— description 是文案正文;hashtags 从中提取。alt_text 是无障碍文案。
互动 —— num_comments、likes_count、video_play_count 为 Instagram 暴露的计数。top_comments 是第一条预览评论,含 comments(正文)、user_commenting(作者)、likes_count、profile_picture;无预览评论时为空对象。
媒体资源 —— thumbnail 是主图 URL。video_url 是主视频 URL。audio_url 是 Instagram 音频页 URL(暴露音频资源时)。duration 是主视频时长。media 是轮播与 Post 的逐项明细,每项含 type(image/video)、url、thumbnail、width、height。photos_number、dimensions_height、dimensions_width 描述主媒体。
人物与赞助 —— tagged_users 列出被标记账号(full_name、id、is_verified、profile_pic_url、username)。coauthor_producers 列出 Instagram 返回的合作者记录。is_paid_partnership 标识付费合作。
时间与错误 —— date_posted 是 Instagram 发布时间戳(Unix 秒)。error 与 error_code 在成功时为空,仅在终止失败行上填充。
只采集某个 UTC 起始日期当天及之后发布的 Reels,边界包含起始当天。
把上一次已采集媒体的 PK 或 shortcode 传入即可跳过。两种形式都会匹配,可混用。
start_date 边界按 UTC 计算,包含起始日期的整天。start_date 时,没有有效发布时间的媒体会被排除。start_date 时,分页会提前停止(避免把极老的主页从头翻到底)。首页出现的较旧置顶内容不会触发提前停止。include_posts 后,Reel 与 Post 候选项按发布时间倒序合并并去重;合并后的成功输出总数不超过 max_results。media/<pk>/info 接口,单一接口缺口不会丢失记录。403、408、425、429、500、502、503、504)或页面结构异常的失败重试,带退避。可以传入单条 Reel 或 Post URL 吗?
不可以。url 字段只接受 Instagram 主页 URL。单条 Reel(/reel/...)、单条 Post(/p/...)、Hashtag、Explore URL 都会被拒绝。
一次能处理多少个 URL?
每个 worker 任务只处理一行主页 URL。如需采集多个主页,请按主页提交多个任务,或调度多次运行。
max_results 会分别限制 Reels 和 Posts 吗?
不会。max_results 是该主页成功记录的合并上限。开启 include_posts 后,Reels 与 Posts 在合并去重后共享这一上限。
支持哪些日期格式?
DD/MM/YYYY、MM-DD-YYYY、YYYY-MM-DD、MM/DD/YYYY、YYYY/MM/DD。start_date 可省略。
日期筛选用哪个时区?
UTC。边界按 UTC 包含起始日期的整天。
脚本会下载视频或图片吗?
脚本返回规范的资源 URL(video_url、thumbnail 与 media 数组),但不会下载二进制文件。请在自己的下载环节使用导出的 URL。
主页是私密的或被封锁时怎么办?
脚本会输出一条携带 error 和 error_code 的终止记录(例如 Instagram 拦截请求时为 403),而不是返回残缺数据。
能当作 REST API 使用吗?
可以。CoreClaw 通过 OpenAPI v2 REST API 暴露该 worker。Base URL 为 https://openapi.coreclaw.com,所有路径以 /api/v2 开头,鉴权 Authorization: Bearer <API_KEY>(legacy api-key header 与 ?token= query 仍兼容)。典型流程:获取输入 schema → POST /api/v2/workers/{workerId}/runs(输入放在 input.parameters.custom,可设 callback_url)→ 保存 data.run_slug → GET /api/v2/worker-runs/{runId} 查状态 → GET /api/v2/worker-runs/{runId}/result 取结果,或 /result/export 导出下载。也可通过 CoreClaw MCP server 在 AI 工具中驱动。
支持哪些导出格式?
CSV、JSON、JSONL、XLSX、XLS、XML、HTML、RSS,可通过 CoreClaw 结果导出获取。
在哪里找 API Key 与价格?
API 访问与用量在 CoreClaw 价格页 管理,完整参考见 API 文档。
发现 bug、缺少字段或想要新功能?在 Core-Claw GitHub 组织 提 issue,或联系 CoreClaw 支持。
探索商店中更多热门采集工具
by CoreClaw
通过链接提取 Instagram 公开帖子数据,包含用户信息、互动数据与主页详情。一键导出 CSV/JSON,支持批量采集,无需代码操作。
by CoreClaw
Instagram 评论抓取工具 (by 帖子URL) 采集 Instagram 帖子和 Reels 的评论数据。你可以把这些评论数据用于情感分析、受众研究、内容审核和互动报告。
by CoreClaw
通过输入一个或多个Reel 链接,从公开的 Instagram Reels 中抓取创作者详情、标签、评论、互动数等数据,支持媒体归档与结构化数据输出。
by CoreClaw
批量获取 Instagram 主页公开 Posts 和 Reels 数据,包括帖子内容、互动信息、媒体链接及作者信息,满足账号分析、内容研究和数据分析需求。