抓取为 Markdown
将网页转换为干净的 Markdown,便于文档编写、内容迁移或为 LLM 上下文做准备。
ScrapeGraphAI 是一款网页抓取 API,可在无需管理代理、选择器或抓取维护的情况下,从网站提取结构化数据。支持抓取、提取、搜索、爬取、监控及集成,适用于开发和自动化工作流。
ScrapeGraphAI 是一款网页抓取 API 和由 AI 驱动的数据提取平台,可将网站转换为结构化输出。它面向那些需要从网页收集数据、但不想管理代理、选择器或持续抓取维护的用户。
该产品提供用于抓取、提取、搜索、爬取和监控网页的端点。它还为 Python、JavaScript、CLI 工作流、MCP 以及多种 AI 和自动化工具提供 SDK 和集成,因此团队可以将网页数据直接连接到应用、智能体和内部工作流中。
将网页转换为干净的 Markdown,便于文档编写、内容迁移或为 LLM 上下文做准备。
通过描述所需的模式和字段,从页面中提取结构化 JSON。
在一次请求中搜索网页并从结果中提取字段,适用于研究和监控任务。
爬取网站并从每个链接页面收集结构化数据,用于全站级流程和审计。
监控页面变化,并在监控内容发生变化时通过 webhook 发送更新。
通过 Python、JavaScript、CLI、MCP 以及受支持的 AI 或自动化平台使用该 API。
跟踪电商平台或市场网站上的价格和库存,并在监控值发生变化时作出响应。
从公开网页中提取个人资料、公司联系人或其他潜在客户数据,并整理为结构化格式。
将来自多个来源的评论、评分和情绪汇总到研究或报告工作流中。
监控房地产网站上的房源和变动,以获取新增库存或价格更新。
通过 MCP 将网页数据连接到 Claude、Cursor 或其他 AI 工具,用于智能体驱动的工作流。
ScrapeGraphAI 提供用于抓取、提取、搜索、爬取和监控网页内容的 API 端点。主页展示了 curl、Python 和 JavaScript 的代码示例,集成页面则列出了 Python、JavaScript、CLI、LangChain、CrewAI、LlamaIndex、n8n、Zapier 和 Make 等 SDK 与工作流工具。
来源显示,该 API 可以返回干净的 Markdown、通过提取提示生成的结构化 JSON、带有提取字段的搜索结果,以及通过 webhook 发送的监控内容变化。定价页面还提到了抓取端点中的 HTML 和截图。
主页和集成页面显示,官方支持 Python SDK、JavaScript SDK、CLI、MCP 以及多个 AI 和自动化平台。这使它既适合个人开发者,也适合构建自动化数据工作流的团队。
定价页面显示有免费层、按月付费计划、企业定制定价和一次性充值额度。页面还说明所有请求都符合 SOC 2 Type I。
主页说明该 API 的设计目标是在无需代理、选择器或维护的情况下工作,但定价页面也列出了在更高套餐或已配置时可选的代理轮换和隐身相关抓取设置。