

通过 URL 抓取 LinkedIn 公开个人资料数据,包括姓名、职位标题、所在地区、当前公司、工作经历、教育背景、技能、粉丝数等信息。支持数据导出、API 调用以及与第三方工具集成。
LinkedIn People Profiles Scraper 一键提取领英个人主页上的公开信息,并将其转化为结构化数据。只需提供一个或多个主页链接,即可获取姓名、所在地、职位、工作经历、教育背景、资质认证等字段,直接用于线索补全、人才挖掘或竞品调研。
| 👤 姓名(名、姓)、头像和封面图 | 📍 城市、国家代码和完整所在地 |
| 💼 当前职位、资历和公司头衔 | 🏢 当前公司(名称、链接、公司 ID、地点) |
| 📝 个人简介(About) | 📧 邮箱和手机号(公开列出时) |
| 📄 工作经历(职位、公司、日期、描述、地点) | 🎓 教育背景(学校、学位、专业、日期、Logo) |
| 📜 资质认证(名称、颁发机构、日期、编号) | 📚 课程和语言 |
| 🏆 荣誉与奖项 | 📰 出版物和专利 |
| 🛠 项目和组织协会 | 🤝 志愿服务经历 |
| 👥 粉丝数和联系人数 | 💬 推荐(推荐数、推荐人姓名、推荐内容) |
| 📢 近期动态 / 帖子(标题、链接、互动类型) | 🔗 外部链接、相似主页和「看过的人还看了」 |
| 🆔 领英 ID 和主页链接 | 🖼️ 默认头像标识 |
为了最大化数据采集效果,LinkedIn People Profiles Scraper 提供以下能力:
用于指定一个或多个需要采集的领英个人主页链接。
每个值必须是以 https:// 开头、包含 /in/ 路径的完整领英主页 URL。可以提供单个链接或多个链接组成的列表;每个链接独立处理,各自返回一条结果记录。
链接须符合标准的领英公开主页格式:
其中 <profile-slug> 是该用户主页的唯一标识符(例如 tony-reagins-53582693)。
单个主页:
多个主页:
每次运行成功后会生成结果数据,您可以在「输出(Output)」面板中查看。默认以表格形式展示,并附带分类标签,方便您分组浏览;您也可以一键切换为 JSON 格式查看。
如需导出,您可以将数据导出为 CSV、JSON、JSONL、XLS、XLSX、HTML、XML 或 RSS。导出前,您既能按需勾选或去掉某些字段,也可以直接下载完整视图——包含所有相关联的数据。
表格支持多种浏览方式。您可以查看总览,也可以按工作经历、教育背景、所在地等字段进行分组筛选,点击即可查看对应分组的数据。
当您采集一个领英主页时,会返回一条完整的数据记录,包含个人信息、工作经历、教育背景、资质认证以及其它公开可见的部分。
采集器会提取每个公开主页的完整职业经历和教育背景。工作经历条目包含职位名称、公司名称、日期、地点和描述;教育背景条目包含学校名称、学位、专业和日期。
采集器还会收集相关主页推荐,包括「相似主页」(基于内容相似度算法推荐)和「看过的人还看了」(基于浏览行为推荐)。这些数据可用于发现更多联系人或扩展潜在客户名单。
LinkedIn People Profiles Scraper 的工作方式类似于在浏览器中打开一个领英主页并阅读公开可见的信息。脚本使用无头浏览器加载每个主页链接,等待页面完全渲染,滚动触发懒加载的内容区块,然后解析可见的 HTML 来提取结构化字段。
输入列表中的每个链接都会被独立处理。采集器导航到对应的主页,收集所有公开可用的部分(个人信息、工作经历、教育背景、资质认证、推荐、帖子等),并以结构化记录的形式返回数据。
如果某个主页链接跳转到登录墙(authwall)、验证码页面或 404 页面,采集器会返回一条包含该输入链接和错误标识的记录,方便您识别哪些主页未成功采集。对于采集失败的主页,不会返回部分或错误的数据。
您无需提供自己的领英账号凭据。采集器内部会处理浏览器会话。不过,领英上某些主页板块可能仅对已登录用户可见,因此采集器返回的是每个主页的公开可见部分。
可以。profile_url 输入参数接受一个链接数组,您可以在单次运行中提交多个主页链接。每个链接独立处理,各自返回一条结果记录。
某些主页板块(如邮箱、手机号或完整工作经历)可能仅在用户将其设为公开时才可采集。采集器会提取所有公开可见的内容,无法访问私有或受限字段。
可以。从 CoreClaw 导出 CSV、JSON、JSONL、XLS、XLSX、HTML、XML 或 RSS,然后导入电子表格、数据库、CRM、BI 工具或自动化工作流。你也可以使用 CoreClaw REST API、MCP server,或自己的自动化层来启动采集运行、检查运行状态、获取分页结果,或按工作流需要的格式导出结果。
可以。你可以使用 CoreClaw REST API 以程序化方式运行该采集器。基础 URL 为 https://openapi.coreclaw.com,所有接口路径均以 /api/v2 开头。鉴权使用 Authorization: Bearer YOUR_API_KEY。
典型 API 工作流如下:
GET /api/v2/workers/{workerId}/input-schema 获取该 Worker 的输入 schema。POST /api/v2/workers/{workerId}/runs 启动运行,传入 is_async,并将采集器输入放在 input.parameters.custom 下。也可设置 callback_url 以接收状态回调,免去轮询。data.run_slug。GET /api/v2/worker-runs/{runId} 检查运行状态(将 run_slug 作为 {runId})。GET /api/v2/worker-runs/{runId}/result 获取结果,或使用 GET /api/v2/worker-runs/{runId}/result/export 导出文件。许多网页采集场景涉及公开可用数据,但合法性取决于数据、司法辖区、目的以及你如何处理个人信息。请尊重个人数据和知识产权规则,仅在有正当理由时进行采集,并根据你的使用场景审阅领英的服务条款。
我们一直在改进这个采集器的性能和覆盖范围。如果你发现 bug 或注意到缺失字段,请提供输入设置、大致运行时间和一小段输出样本,可以反馈到网页的在线客服或者邮箱 support@coreclaw.com,以便我们复现该行为并修复维护。
探索商店中更多热门采集工具
by CoreClaw
通过关键词,提取 LinkedIn 上公开的职位招聘数据。包括职位名称、公司名称、职位描述、经验级别、薪资范围、申请链接等信息,并支持数据导出、API 调用或与第三方工具集成。
by CoreClaw
通过输入 LinkedIn 公司主页 URL,提取公开的公司资料数据。包括公司名称、公司规模、行业、简介、主页链接等信息,并支持数据导出、API 调用或与第三方工具集成。
by CoreClaw
通过输入职位列表 URL,提取 LinkedIn 上公开的职位招聘数据。包括职位名称、公司名称、职位描述、经验级别、薪资范围、申请链接等信息,并支持数据导出、API 调用或与第三方工具集成。
by CoreClaw
通过输入职位 URL,提取 LinkedIn 上公开的职位数据。包括职位名称、公司名称、职位描述、经验级别、薪资范围、申请链接等信息,并支持数据导出、API 调用或与第三方工具集成。