擷取為 Markdown
將網頁轉換為乾淨的 Markdown,適合文件、內容移轉或 LLM 上下文準備。
ScrapeGraphAI 是一款網站擷取 API,可從網站提取結構化資料,無需管理代理伺服器、選擇器或爬蟲維護,並支援擷取、搜尋、爬取、監控與整合,適用開發與自動化流程。
ScrapeGraphAI 是一款網站擷取 API 與 AI 驅動的資料提取平台,可將網站轉換為結構化輸出。它的定位是協助需要從網頁收集資料、但不想管理代理伺服器、選擇器或持續爬蟲維護的使用者。
此產品提供用於擷取、提取、搜尋、爬取與監控網頁的端點。它也提供 Python、JavaScript、CLI 工作流程、MCP,以及多種 AI 和自動化工具的 SDK 與整合,讓團隊能直接將網路資料串接到應用程式、代理程式與內部流程中。
將網頁轉換為乾淨的 Markdown,適合文件、內容移轉或 LLM 上下文準備。
透過描述你想要的結構與欄位,即可從頁面提取結構化 JSON。
在單一請求中搜尋網路並從結果中提取欄位,適合研究與監控任務。
爬取網站並從每個連結頁面收集結構化資料,適用於整站流程與稽核。
監看頁面變更,當受監控內容有更新時透過 webhook 發送通知。
可透過 Python、JavaScript、CLI、MCP 與支援的 AI 或自動化平台使用此 API。
追蹤市集或電商網站上的價格與庫存,並在監控值變動時採取行動。
將公開網頁中的個人檔案、公司聯絡資訊或其他潛在客戶資料提取成結構化格式。
將多個來源的評論、評分與情緒彙整到研究或報告流程中。
監控房地產網站上的物件刊登與變化,以掌握新上架物件或價格更新。
透過 MCP 將網頁資料連接到 Claude、Cursor 或其他 AI 工具,以支援代理驅動的工作流程。
ScrapeGraphAI 提供用於擷取、提取、搜尋、爬取與監控網頁內容的 API 端點。首頁展示了 curl、Python 和 JavaScript 的程式碼範例,而整合頁面列出了 Python、JavaScript、CLI、LangChain、CrewAI、LlamaIndex、n8n、Zapier 與 Make 等 SDK 和工作流程工具。
來源顯示,該 API 可回傳乾淨的 Markdown、由提取提示產生的結構化 JSON、包含擷取欄位的搜尋結果,以及透過 webhook 傳送的監控內容變更。價格頁也提到 scrape 端點支援 HTML 和截圖。
來源首頁與整合頁顯示,官方支援 Python SDK、JavaScript SDK、CLI、MCP,以及多種 AI 與自動化平台。這使它適合個別開發者與打造自動化資料流程的團隊使用。
價格頁顯示有免費方案、每月付費方案、企業自訂計費,以及一次性點數加值。頁面也指出所有請求皆符合 SOC 2 Type I。
首頁說明此 API 設計為可在不需要代理伺服器、選擇器或維護的情況下運作,但價格頁也列出在較高方案或經設定後可用的可選代理輪換與隱匿相關擷取設定。