感知版式的文档解析
Parse 的读取方式类似人工阅读,保留版式、结构、阅读顺序、边界框和置信度分数,使下游系统可以引用页面上的精确区域。
Reducto 是面向 AI 团队的智能文档平台,可通过 Studio 和 API 工作流解析、抽取、拆分、分类和编辑文档,将 PDF、扫描件、表格、幻灯片和表单转为可追溯的结构化输出,适用于生产级规模。
Reducto 是面向需要在生产级规模上解析、抽取、拆分、分类和编辑文档的团队而构建的智能文档平台。该产品定位为面向文档密集型 AI 工作流的工具包,提供 Studio 和 API 访问,用于围绕 PDF、扫描件、表格、幻灯片、表单和 Office 文件构建管道。
该平台结合了感知版式的文档理解、agentic OCR 和基于 schema 的抽取。其 Parse 工作流会生成带边界框和置信度分数的结构化片段,而 Extract 会为已定义字段返回类型化 JSON。Split 可将多文档文件分离为逻辑单元,Edit 则可在不依赖固定模板或边界框的情况下将数据写回文档。
Parse 的读取方式类似人工阅读,保留版式、结构、阅读顺序、边界框和置信度分数,使下游系统可以引用页面上的精确区域。
Extract 会为定义字段返回符合 schema 类型的 JSON,并可为每个值提供可选引用,同时支持固定 schema 和基于提示词的原型验证。
Split 可识别长文档或多文档文件中的章节边界,并返回页码范围,以便分别处理每个部分。
Edit 可填写识别出的空白处、表格和复选框,或更新 DOCX 文件,而无需边界框或预定义模板,然后输出编辑后的文件和可复用的表单 schema。
平台使用 agentic OCR 和 VLM 审核来纠正褪色扫描件、特殊字体、手写内容、列对不齐以及传统 OCR 可能遗漏的其他边缘情况。
Reducto 支持同步和异步处理、批处理任务的 webhook 投递,以及较大文件的预签名 URL 上传。
当你需要为 RAG、文档 AI 代理或任何受益于类型化块、页面位置和置信度分数的管道提供文档的结构化表示时,使用 Parse。
当输出需要匹配固定 schema 时使用 Extract,例如发票字段、合同条款、入职记录或下游代码期望以类型化 JSON 获取的财务报表数据。
在解析或抽取之前,使用 Split 将长文件或多文档包拆分为逻辑部分,尤其适用于单次上传包含多个表单或报告的情况。
当工作流需要将数据写回 PDF 表单或 DOCX 文件时,使用 Edit,包括空白字段、表格和复选框,而无需手工搭建模板。
适用于表格密集和扫描密集的文档场景,在这些场景中,版式、合并单元格、手写内容、褪色文字或特殊格式会使传统 OCR 变得不可靠。
Reducto 通过其 API 和 Studio 提供 Parse、Extract、Split、Classify 和 Edit 工作流。Parse 会将文档转换为带类型块和边界框的结构化片段;Extract 返回符合 schema 的 JSON;Split 将多文档文件拆分为逻辑部分;Edit 会将数据写回文档。
来源将 Reducto 描述为可通过 API 和 Studio 使用,并支持同步和异步工作流。Parse 还提到可直接上传文件或传入公开 URL 或预签名 URL,而异步任务可以使用 webhook。
定价页面描述了基于信用点的方案,包括 Standard、Growth 和 Enterprise 层级。页面还提到免费积分、低阶方案中 Reducto Studio 最多 5 个席位,以及企业级选项,如 VPC 或本地部署、自定义协议和 RBAC。
来源明确提到 HIPAA、SOC 2 Type II、零数据保留、区域端点、VPC 和本地部署选项,以及企业方案中的 SSO/SAML。这些细节出现在定价页和 Parse 页面上,但任何合规要求仍应针对具体部署直接向 Reducto 确认。
产品页面说明 Reducto 支持 PDF、图像、表格、Office 文档、幻灯片、表单、扫描件和长篇多文档文件。它面向 RAG、文档 AI 代理、表格抽取、发票处理和表单处理等工作流。