OCR 和文档解析
使用 `/parse` 端点解析扫描文档、表格、手写内容和多栏版式,并将其转换为结构化 Markdown。
LightOn 是面向文档智能与 AI 搜索的平台,可解析文件、提取结构化数据,并带引用返回有依据的答案,适合开发者、产品团队和企业在自有文档上进行搜索与推理。
LightOn 是围绕三个 API 端点构建的文档智能与检索平台:`/parse`、`/extract` 和 `/search`。它旨在将文件转换为结构化输出,使用受引导的 schema 提取特定字段,并返回带引用的依据性搜索结果。
该产品面向开发者、交付生产系统的团队以及需要在自有文档上进行搜索与推理的大型组织。网站重点强调适用于扫描件和复杂版式的 OCR、JSON 提取、混合检索、来源支撑的答案,以及包括欧盟主权托管和企业环境在内的部署选项。
使用 `/parse` 端点解析扫描文档、表格、手写内容和多栏版式,并将其转换为结构化 Markdown。
通过提供 JSON schema 来提取字段、实体或键值对,并在响应中返回结构化 JSON。
运行带有密集、稀疏和 late-interaction 信号的依据性检索,并为每个结果返回来源段落。
在浏览器 Console 中测试端点,然后将代码复制到项目中,无需安装额外工具。
使用 workspaces 和 chunk 级 ACL 来限定团队和 agent 的访问范围,并在付费方案中提供镜像的源权限和审计日志。
在按量计费的 API 方案或企业部署选项之间进行选择,包括云、VPC、on-prem 和区域托管。
通过原生 MCP 工作流连接,并将 API 与已经支持 Model Context Protocol 的 agent 或应用集成。
在下游处理之前,使用 `/parse` 将扫描 PDF、表格、手写内容和多栏文档转换为结构化文本。
当你需要将发票编号、合同条款、索赔 ID 或类似字段按与你的 schema 匹配的 JSON 返回时,使用 `/extract`。
使用 `/search` 结合带引用的段落回答公司文件中的问题,以便用户核实每个答案的来源。
在 agent 工作流中使用该 API,让系统检索相关段落、串联步骤,并基于内部文档生成答案。
当团队需要在工作区和权限之间安全访问敏感知识时,使用企业界面和部署选项。
LightOn 提供三个主要 API 端点:`/parse` 用于 OCR 和文档结构化,`/extract` 用于按指导式 JSON 进行提取,`/search` 用于带引用的依据性检索。
是的。定价页面显示了 Starter 级别,提供免费的按量使用;Business 级别面向团队;Enterprise 级别提供定制部署和支持。
定价页和 API 页提到可在浏览器版 Console 中测试、复制粘贴代码示例,以及 Enterprise 的部署选项,包括欧盟主权托管、VPC、on-prem 和区域选项。
LightOn 表示答案会附带来源段落,检索过程可审计,并通过 chunk 级访问控制以及 workspace 来限定语料范围。