HTML API
通过单次 API 调用从公开网站获取原始页面内容,适合需要完全控制提取逻辑的自定义解析器和数据管道。
ScrapingBee 是一款网页抓取 API,支持代理轮换和浏览器渲染,帮助团队无需自建抓取基础设施即可采集网站数据。支持原始 HTML、Markdown、纯文本、结构化 JSON、截图及交互页面自动化工作流。
ScrapingBee 是一款用于从网站收集数据的网页抓取 API,无需你自行管理代理池或浏览器基础设施。它面向需要抓取页面、渲染 JavaScript、提取结构化数据并在规模化场景下支持抓取工作流的团队。
该产品将通用 HTML API 与 Markdown 和纯文本输出、基于 AI 的提取、JavaScript 场景、截图,以及针对搜索和电商等特定来源的专用 API 结合在一起。定价页面显示有多个付费方案,以及一个无需信用卡即可获得 1,000 credits 的入门优惠。
通过单次 API 调用从公开网站获取原始页面内容,适合需要完全控制提取逻辑的自定义解析器和数据管道。
将页面转换为干净的 Markdown 或纯文本,让输出更易阅读、解析,并用于 LLM 或数据处理工作流。
描述你想要的字段即可返回结构化 JSON,无需编写选择器,使用 AI 辅助提取,让请求设置更自然。
在无头 Chrome 中渲染页面,等待选择器,运行点击、滚动和填写表单等交互场景,并捕获渲染结果的截图。
当你需要针对特定页面元素和页面结构进行定向提取时,可使用 CSS 或 XPath 规则。
让平台自动轮换代理,并为更难访问的网站提供高级、隐身和按国家/地区定位的代理选项。
构建数据管道,在你希望控制提取逻辑时,收集页面内容用于自定义解析、数据增强或下游分析。
获取适合 LLM 的文本或 Markdown,用于模型训练、检索或内容处理,而无需花时间清理 HTML 噪声。
自动抓取在数据可见前需要执行 JavaScript、点击、滚动、等待或填写表单的页面。
使用通用 API 或可用的专用电商端点,监控商品价格、列表、评价和市场变化。
通过 make、n8n、Zapier、MCP server 或 ScrapingBee CLI,将实时网页数据接入自动化工作流和 AI 工具。
ScrapingBee 提供一个网页抓取 API,替你处理代理和无头浏览器渲染。它可以返回原始 HTML、Markdown、纯文本、来自提取规则或 AI 查询的结构化 JSON、截图,以及针对特定工作流的专用 API 输出。
来源显示它支持 make、n8n、Zapier 和一个 MCP server 集成,还提供一个 CLI,可连接 ChatGPT、Claude、Codex、Cursor、Claude Code 和 Gemini 等 AI 编程工具。
定价页面列出了 Freelance、Startup、Business、Business + 和 Custom 方案。页面还说明你可以通过 1,000 个免费 API credits 试用 ScrapingBee,而且注册无需信用卡。
ScrapingBee 的功能页显示支持 JavaScript 渲染、自定义交互场景、Markdown 和纯文本输出、CSS/XPath 提取规则以及基于 AI 的结构化提取。具体输出取决于你选择的工作流。
现有来源未提供完整的设置限制或团队功能列表。定价页面确实显示较高档方案才包含专属客户经理和团队管理,而公开功能页则强调由工程师编写的文档和支持。