瀏覽器中的 AI 引導式爬取
Thunderbit 的瀏覽器擴充功能圍繞一個簡單流程設計:先輸入想要的欄位名稱,再讓 AI 擷取資料。產品頁面表示沒有傳統編輯器或建立選擇器的步驟。
Thunderbit 是一款 AI 網頁爬蟲工具,提供 Chrome 擴充功能與 API,可將網頁轉換為結構化資料。支援銷售、營運、電商與開發流程,匯出為試算表、Markdown、JSON 或 CSV。
Thunderbit 是一款 AI 網頁爬蟲產品,同時提供 Chrome 擴充功能與網頁爬蟲 API。瀏覽器擴充功能適合希望透過幾次點擊快速擷取網站資料的人,而 API 則適合需要在自己的應用程式與內部工作流程中使用結構化網頁資料的開發者。
在整個產品網站中,Thunderbit 被定位為可將網站轉成試算表、Markdown、JSON 或表格等整理後輸出的工具,且不需要手動處理選擇器。擴充功能頁面強調潛在客戶名單、SKU 資料、分頁、子頁面,以及匯出到 Google Sheets、Airtable、Notion 和 Excel 等工具。API 頁面則強調零維護擷取、基於 schema 的輸出,以及面向 RAG、agents 和資料增補用途的內容精簡。
Thunderbit 的瀏覽器擴充功能圍繞一個簡單流程設計:先輸入想要的欄位名稱,再讓 AI 擷取資料。產品頁面表示沒有傳統編輯器或建立選擇器的步驟。
擴充功能支援帶有分頁、多個 URL、登入保護內容、螢幕截圖與其他檔案上傳的頁面,擴大了可處理的頁面範圍。
Thunderbit 可擷取可見與隱藏的頁面資料,包括文字、URL、圖片、電子郵件、電話號碼與日期,因此輸出不只限於純文字。
內建格式化工具可在擷取過程中摘要、分類、翻譯並重新格式化資料,減少匯出後的手動整理。
匯出路徑包括 Google Sheets、Airtable、Notion、Excel,以及複製貼上到其他應用程式,方便快速把結果帶入既有工作流程。
API 產品提供兩種核心模式:Distill 可將網頁轉為較乾淨的 Markdown 內容,Extract 則以 JSON 或 CSV 回傳結構化資料。
從目錄、個人檔案頁面與其他公開來源蒐集潛在客戶資料、聯絡資訊與增補資料,然後將結果帶入試算表以便進行外聯或審核。
從商店或市集列表中擷取產品名稱、價格、可用性、圖片與描述,以支援型錄作業、庫存檢查或競品追蹤。
從房地產網站與在地列表頁面蒐集物件清單、開放看屋資訊與相關聯絡資料,供分析或監控使用。
將文章、逐字稿或網頁內容轉為較乾淨的 Markdown,以供 RAG 管線、知識庫或下游 AI 工作流程使用。
使用以 schema 為基礎、較容易維護的 API 工作流程,隨時間追蹤各頁面的價格、庫存、評論或內容變化。
Thunderbit 設計為可在瀏覽器擴充功能中使用,也提供網頁爬蟲 API。擴充功能可讓你從 Chrome 中的頁面開始操作,而 API 則適合將爬取整合到應用程式與工作流程中。
Chrome 擴充功能的定位是以幾次點擊就能抓取網站資料,不需要選擇器或手動拖放。產品頁面將它描述為適合潛在客戶蒐集、SKU 收集、分頁、多頁抓取,以及匯出資料到試算表類工具。
Thunderbit 的 API 可以從 URL 回傳結構化 JSON 或 Markdown。文件與 API 頁面顯示兩種主要模式:Distill 用於整理內容,Extract 用於結構化資料。
定價頁顯示 Free、Basic、Professional 與 Business 方案,也提到有免費方案、免費試用,以及可透過年繳享有折扣。不過目前這些資料不足以確認確切限制或價格。
來源頁面沒有提供足夠細節來確認團隊功能、帳號協作或確切用量限制。購買前應先查看定價與文件頁面。