OCR 與文件解析
使用 `/parse` 端點將掃描文件、表格、手寫內容與多欄版面解析並轉為結構化 Markdown。
LightOn 是文件智慧與 AI 搜尋平台,可解析檔案、擷取結構化資料,並以引用來源回傳有根據的答案,適合開發者、產品團隊與企業進行自有文件搜尋與推理。
LightOn 是一個文件智慧與檢索平台,核心圍繞三個 API 端點:`/parse`、`/extract` 與 `/search`。其設計目的是將檔案轉為結構化輸出、透過引導式 schema 擷取特定欄位,並回傳帶有引用來源的有根據搜尋結果。
此產品定位於開發者、推出生產系統的團隊,以及需要在自有文件上進行搜尋與推理的大型組織。網站強調可處理掃描件與複雜版面的 OCR、JSON 擷取、混合檢索、來源支撐的答案,以及包含 EU 主權託管與企業環境在內的部署選項。
使用 `/parse` 端點將掃描文件、表格、手寫內容與多欄版面解析並轉為結構化 Markdown。
透過提供 JSON schema 來擷取欄位、實體或鍵值對,回應中會傳回結構化 JSON。
結合 dense、sparse 與 late-interaction 訊號進行有根據的檢索,並在每個結果中回傳來源段落。
可在瀏覽器 Console 中測試端點,之後直接將程式碼複製到專案中,無需安裝額外工具。
透過工作區與 chunk 層級 ACL 限制團隊與代理的存取範圍,付費方案則提供鏡像來源權限與稽核日誌。
可在按用量計費的 API 方案或企業部署選項之間選擇,包括雲端、VPC、地端與區域託管。
透過 MCP 原生工作流程連接,並將 API 與已支援 Model Context Protocol 的代理或應用程式整合。
使用 `/parse` 將掃描 PDF、表格、手寫內容與多欄文件轉為結構化文字,再進行下游處理。
當你需要將發票編號、合約條款、理賠編號或類似欄位依照你的 schema 以 JSON 回傳時,使用 `/extract`。
使用 `/search` 從公司檔案中回答問題,並附上引用段落,讓使用者能驗證每個答案的來源。
在代理工作流程中使用此 API,當系統需要擷取相關段落、串接步驟,並根據內部文件產生答案時。
當團隊需要跨工作區與權限安全存取敏感知識時,使用企業介面與部署選項。
LightOn 提供三個主要 API 端點:`/parse` 用於 OCR 與文件結構化,`/extract` 用於引導式 JSON 擷取,而 `/search` 則用於帶有引用來源的有根據檢索。
是的。定價頁面顯示 Starter 方案提供免費、按用量計費的存取,Business 方案適合團隊,Enterprise 方案則提供量身打造的部署與支援。
定價頁面與 API 頁面提到可在瀏覽器 Console 中測試、可直接複製貼上程式碼範例,以及包含 EU 主權託管、VPC、地端部署與 Enterprise 區域選項等部署方式。
LightOn 表示答案會附帶來源段落,且檢索具備可稽核性;同時透過 chunk 層級的存取控制與工作區來界定語料範圍。