説明
LightOnは、「AIをドキュメントに向ける」ための強力なAI検索APIを提供します。ドキュメント構造化のための`/parse`、定義されたスキーマに基づいた特定フィールドの抽出のための`/extract`、引用付きのグラウンデッド検索のための`/search`という3つのコアエンドポイントを提供します。
`/parse`エンドポイントは、スキャン、テーブル、手書き、複数カラムレイアウトを構造化されたMarkdownに変換する最先端の解析エンジンであるLightOnOCR-2を利用しています。ネイティブで20以上の言語をサポートし、HuggingFaceで利用可能なオープンウェイトに基づいて構築されており、OLMOCR-BENCHで83.2を達成しています。
`/extract`エンドポイントを使用すると、ユーザーはJSONスキーマを定義し、構造化されたJSON出力を受け取ることができます。これにより、請求書番号、リース終了日、契約条項などの特定のエンティティを抽出できます。この機能はページ単位で課金され、Webhookによる非同期処理をサポートしています。
`/search`エンドポイントは、デンス、スパース、レイトインタラクション信号を組み合わせたハイブリッドアプローチを活用し、引用付きのグラウンデッド検索を提供します。オープンソースのColBERTファミリー(LateOnおよびNextPlaid)に基づいて構築されており、すべての検索結果にそれを生成した正確なソースパッセージが付属することを保証します。この機能はクエリ単位で課金され、低レイテンシです。
LightOnはエージェント向けに構築されており、生のPDF、破損したテーブル、ドメイン外のクエリを堅牢な検索機能で処理します。グラウンデッドな結果と監査可能な設計を通じて信頼性を重視しています。プラットフォームはLLMに依存しないため、ユーザーは独自のモデルを持ち込むことができ、VPC、オンプレミス、またはエアギャップデプロイメントをサポートしてセキュリティとコンプライアンスを強化します。
主なユースケースには、カウンターパーティリスク分析、複数管轄区域の契約レビュー、規制境界マッピングなどがあり、知識の即時発見と洞察の表面化が重要です。プラットフォームは、シングルサインオン、ロールベースアクセス、GDPR/SOC 2コンプライアンスなどの機能を提供します。開発者がコンソールで全エンドポイントをテストできる無料ティアも利用可能です。
LightOn AIの主要機能
OCRによるドキュメント解析
構造化データ抽出
引用付きグラウンデッド検索
多言語サポート(20言語以上)
ハイブリッド検索(デンス、スパース、レイトインタラクション)
LLM非依存アーキテクチャ
オープンソースモデル(ColBERTファミリー)
プロダクションレディAPI
無料ティアあり
EUホストインフラストラクチャ
ロールベースアクセス制御
チャンクレベルでのワークスペースとACLスコープ
外部ソースからのデータ同期
LightOn AIの使い方は?
コンソールにアクセス: プレイグラウンドコンソールでエンドポイントを試してください。
APIを設定: コンソールおよびエンタープライズ版のAPIキーを取得してください。
ドキュメントを解析: /parseエンドポイントを使用して構造化されたMarkdown出力を取得してください。
フィールドを抽出: 定義されたJSONスキーマを使用して/extractエンドポイントを利用してください。
検索を実行: 引用付きグラウンデッド検索のために/searchエンドポイントを使用してください。
APIを統合: コードスニペットをプロジェクトにコピーしてアプリケーションに統合してください。
エンタープライズ版をデプロイ: VPC、オンプレミス、またはエアギャップデプロイメントオプションについてご相談ください。
LightOn AIの使用例
- ドキュメント分析
- 情報検索
- エージェント開発
- 契約レビュー
- リスク評価
- 規制コンプライアンス
- ナレッジマネジメント
- エンタープライズ検索








