OCRと文書解析
`/parse` エンドポイントを使って、スキャン文書、表、手書き文字、複数カラムのレイアウトを構造化Markdownに解析します。
LightOnは、ファイル解析、構造化データ抽出、引用付きの根拠ある回答を返す文書インテリジェンスとAI検索プラットフォーム。開発者や企業向け。
LightOnは、`/parse`、`/extract`、`/search` という3つのAPIエンドポイントを中心に構成された文書インテリジェンスと検索プラットフォームです。ファイルを構造化出力に変換し、ガイド付きスキーマで特定フィールドを抽出し、引用付きの根拠ある検索結果を返すよう設計されています。
この製品は、開発者、本番システムを提供するチーム、そして自社文書に対する検索と推論を必要とする大規模組織向けに位置付けられています。サイトでは、スキャンや複雑なレイアウト向けのOCR、JSON抽出、ハイブリッド検索、ソースに基づく回答、EU主権ホスティングやEnterprise環境を含むデプロイオプションが強調されています。
`/parse` エンドポイントを使って、スキャン文書、表、手書き文字、複数カラムのレイアウトを構造化Markdownに解析します。
JSONスキーマを指定して、フィールド、エンティティ、キー・バリュー対を抽出し、構造化されたJSONを応答として返します。
dense、sparse、late-interactionのシグナルを組み合わせた根拠ある検索を実行し、各結果にソースの抜粋を返します。
ブラウザのConsoleでエンドポイントをテストし、追加ツールをインストールせずにコードをプロジェクトへ貼り付けられます。
ワークスペースとチャンクレベルのACLを使って、チームやエージェントのアクセス範囲を制御し、有料プランではソース権限の同期と監査ログも利用できます。
従量課金のAPIプラン、またはクラウド、VPC、オンプレミス、リージョナルホスティングを含むEnterprise向けデプロイオプションから選べます。
MCPネイティブのワークフロー経由で接続し、Model Context Protocolに対応したエージェントやアプリケーションとAPIを統合できます。
`/parse` を使って、スキャン済みPDF、表、手書き文字、複数カラム文書を下流処理の前に構造化テキストへ変換します。
請求書番号、契約条項、申請IDなど、スキーマに一致するJSONで返したいフィールドが必要なときに `/extract` を使います。
引用付きの抜粋を使って社内ファイルに関する質問に答え、利用者が各回答の出典を確認できるように `/search` を使います。
関連する抜粋を取得し、手順を連鎖させ、社内文書に基づいて回答を生成する必要があるエージェントワークフロー内でAPIを使います。
チームがワークスペースと権限をまたいで機密知識へ安全にアクセスする必要がある場合は、Enterpriseインターフェースとデプロイオプションを使います。
LightOnは、OCRと文書の構造化のための `/parse`、ガイド付きのJSON抽出のための `/extract`、引用付きの根拠ある検索のための `/search` という3つの主要なAPIエンドポイントを提供します。
はい。料金ページには、無料で利用できる使用量ベースのStarterプラン、チーム向けのBusinessプラン、個別対応のデプロイとサポートを含むEnterpriseプランが掲載されています。
料金ページとAPIページでは、ブラウザベースのConsoleでのテスト、コピーして使えるコード例、EU主権ホスティング、VPC、オンプレミス、Enterprise向けのリージョナルオプションを含むデプロイ方法が案内されています。
LightOnでは、回答には参照元の抜粋が含まれ、検索は監査可能であり、チャンク単位のアクセス制御とワークスペースによるコーパスの範囲設定が行われると説明されています。