基于浏览器的上传与粘贴流程
在浏览器中上传图片、PDF、Word 文档、截图或粘贴的文本。网站还支持来自 URL 的文件,并支持多页 PDF 和批量处理。
OCR.chat 是一款基于浏览器的 OCR 与文档聊天工具,可将图片、PDF、Word 文件和截图转换为可编辑文本及结构化输出;还可就完成的文档提问,并返回带来源页引用的答案。
OCR.chat 是一款基于浏览器的 OCR 与文档聊天工具,可将图片、PDF、Word 文件和粘贴的截图转换为可编辑文本。它旨在从印刷文档中提取整洁文本,并通过高级 AI 引擎处理更复杂的文档。
该产品支持 100 多种语言,并强调在提取后仍然可用的输出:将真实表格保留为 Markdown 或 CSV,把公式转换为 LaTeX,并进行并排审阅且标记低置信度片段。完成 OCR 后,用户还可以就文档提问,并获得带来源页引用的答案。
该网站还提供用于程序化 OCR 和文档聊天的 REST API。该 API 返回作业对象,支持 5 页及以下文件的内联结果,并允许以多种格式下载完成后的输出。
定价包括无需注册即可开始的免费使用、按月付费方案,以及永不过期的一次性页数包。付费层级可根据方案提供对高级 AI 引擎、更高页数限制、批量处理和 API 使用权限。
在浏览器中上传图片、PDF、Word 文档、截图或粘贴的文本。网站还支持来自 URL 的文件,并支持多页 PDF 和批量处理。
快速引擎用于处理印刷文本,而高级 AI 引擎用于手写、表格、数学和复杂版式。网站还会标记低置信度片段供审阅。
将表格提取为结构化的 Markdown 或 CSV,而不是扁平化文本。OCR.chat 表示在表格提取过程中不会静默丢失任何内容。
将方程和公式转换为 LaTeX,让输出更便于在论文和笔记中复用。该产品还说明外语词会被转写,而不会自动翻译。
提取完成后,你可以与文档聊天,并获得带回到页面的引用答案。该产品将此定位为基于提取内容的有依据问答。
可将结果导出为 TXT、Markdown、DOCX、可搜索 PDF、CSV 或 JSON,也可在同一界面复制到剪贴板。
上传印刷文档或截图,快速在浏览器中将其转换为可编辑文本,尤其适合不想先安装软件或创建账户的情况。
当文件包含手写内容、公式、表格或复杂版式,超出普通文本提取能力时,可使用高级 AI 引擎。
将结构化表格数据提取为 Markdown 或 CSV,以便在无需手动重新排版的情况下进行审阅、复制或导入后续工具。
针对完成的扫描件或 PDF 提出后续问题,并获得基于提取文档、带页码引用的答案。
当需要自动化 OCR、按所选格式下载,或集成到更广泛工作流中时,可通过 REST API 发送文件。
可以。OCR.chat 允许你无需注册即可提取文本,免费账户还会每月增加更多页数。
网站说明支持 PNG、JPG、WEBP、GIF、BMP、TIFF 和多页 PDF,并支持 100 多种语言,包括中日韩文字、阿拉伯文、斯拉夫文和印地文脚本。
支持纯文本、Markdown、Word(DOCX)、可搜索 PDF、CSV、JSON,以及复制到剪贴板。
提供。API 文档描述了一个接受文件上传并返回 OCR 结果的 REST 端点,并为已完成任务提供下载和聊天端点。
文件会被用于 OCR 处理并自动删除,网站表示不会出售、共享或用文档进行训练。