ブラウザベースのアップロードと貼り付けのワークフロー
画像、PDF、Word文書、スクリーンショット、または貼り付けたテキストをブラウザでアップロードできます。サイトはURLからのファイル取得にも対応しており、複数ページのPDFやバッチ処理もサポートしています。
OCR.chatは、画像・PDF・Word・スクリーンショットを編集可能なテキストや構造化出力に変換できるブラウザベースのOCRと文書チャットツールです。
OCR.chatは、画像、PDF、Wordファイル、貼り付けたスクリーンショットを編集可能なテキストに変換する、ブラウザベースのOCRと文書チャットツールです。印刷文書からきれいなテキストを抽出することを目的としており、より複雑な文書にはプレミアムAIエンジンで対応できます。
この製品は100以上の言語をサポートし、抽出後も使いやすい出力に重点を置いています。たとえば、MarkdownまたはCSVの実際の表、LaTeXに変換された数式、信頼度の低い範囲をフラグ表示した左右比較レビューなどです。OCR後は、完成した文書について質問でき、ソースページに引用付きで回答を得られます。
このサイトには、プログラムからOCRと文書チャットを利用できるREST APIもあります。APIはジョブオブジェクトを返し、5ページ以下のファイルではインライン結果をサポートし、完成した出力を複数形式でダウンロードできます。
料金体系には、登録不要で始められる無料利用、月額の有料プラン、期限切れのない一回買い切りのページパックがあります。有料プランでは、プランに応じてプレミアムAIエンジン、高いページ上限、バッチ処理、API利用が追加されます。
画像、PDF、Word文書、スクリーンショット、または貼り付けたテキストをブラウザでアップロードできます。サイトはURLからのファイル取得にも対応しており、複数ページのPDFやバッチ処理もサポートしています。
高速エンジンは印刷テキストを処理し、プレミアムAIエンジンは手書き、表、数式、複雑なレイアウトに使用されます。サイトでは、確認が必要な低信頼度の範囲もフラグ表示されます。
表は平坦化されたテキストではなく、構造化されたMarkdownまたはCSVとして抽出されます。OCR.chatは、表抽出の際に内容が黙って失われることはないとしています。
数式やフォーミュラをLaTeXに変換することで、論文やノートで再利用しやすい出力になります。また、この製品では外国語は自動翻訳ではなく文字起こしされると説明しています。
抽出後は文書とチャットでき、回答はページに引用付きで返されます。この製品は、抽出した内容に基づく根拠のあるQ&Aとして位置づけています。
結果はTXT、Markdown、DOCX、検索可能PDF、CSV、JSONとして書き出すか、1画面からクリップボードにコピーできます。
印刷文書やスクリーンショットをアップロードして、ブラウザ上で素早く編集可能なテキストに変換します。特に、ソフトウェアのインストールや事前のアカウント作成を避けたい場合に便利です。
ファイルに手書き、数式、表、または単純なテキスト抽出以上の対応が必要な複雑なレイアウトが含まれる場合は、プレミアムAIエンジンを使用します。
構造化された表データをMarkdownまたはCSVとして抽出し、手作業での再整形なしにレビュー、コピー、または下流ツールへ移せるようにします。
完成したスキャンやPDFについてフォローアップの質問をし、抽出した文書に基づきページ引用付きで回答を受け取れます。
OCRの自動化、任意形式でのダウンロード、またはより広いワークフローへの統合が必要な場合は、REST APIでファイルを送信します。
はい。OCR.chatでは登録なしでテキスト抽出でき、無料アカウントで毎月さらに多くのページを利用できます。
サイトによると、PNG、JPG、WEBP、GIF、BMP、TIFF、複数ページのPDFに対応しており、CJK、アラビア文字、キリル文字、インド系文字を含む100以上の言語をサポートしています。
プレーンテキスト、Markdown、Word(DOCX)、検索可能PDF、CSV、JSON、クリップボードへのコピーに対応しています。
はい。APIドキュメントでは、ファイルアップロードを受け付けてOCR結果を返すRESTエンドポイントと、完了したジョブ向けのダウンロードおよびチャット用エンドポイントが説明されています。
ファイルはOCRのために処理され、自動的に削除されます。また、サイトでは文書を販売、共有、学習には使用しないとしています。