説明
Doc2Xは、PDFや画像内の数式や表を正確に認識し、Word、LaTeX、HTML、Markdownなどの編集可能な形式に変換するAI駆動の文書および画像解析ツールです。その大規模OCRは、複雑なコンテンツ、特に多段組レイアウト、数学的および化学的方程式、手書きの数式、結合された回転テーブル、コードを処理するように設計されており、学術論文、教科書、企業文書、国家基準、財務報告書に対応しています。
変換に加えて、Doc2Xは大規模モデルによるバイリンガルPDF翻訳を提供します。GPT、DeepSeek、GLM、Qwen、Yi-Lightningなど複数のAIエンジンをサポートし、外国語文書を迅速に理解するための双方向ナビゲーションを備えた並列バイリンガルビューを提供します。数式認識エディタは、Doc2XとMathpixを含む複数のモデルを統合し、認識された方程式を比較および編集するための数式テンプレートライブラリを提供します。
大量のニーズに対応するために、Doc2Xはバッチ認識と変換を提供し、データパイプラインに文書処理を統合するためのAPIを提供しています。これまでに数億ページを処理し、日々数千万ページのスループットを誇っています。典型的な用途には、学術研究、教育、出版、財務および基準文書、RAGおよび大規模モデルのトレーニングコーパス抽出、国際的なコラボレーションが含まれます。
Doc2Xの主要機能
数学の数式や複雑な表に対する高精度OCR
PDFや画像をWord、LaTeX、HTML、Markdownに変換
多段組レイアウト、手書き、コードの認識
並列ビューによるバイリンガルPDF翻訳
複数のAI翻訳エンジン(GPT、DeepSeek、GLM、Qwen、Yi-Lightning)
Doc2XとMathpixの認識を比較する数式エディタ
バッチPDF認識と変換
高スループットの文書処理とパイプライン用API
Doc2Xの使い方は?
アップロード: PDFまたは画像をDoc2Xに追加します。
認識: AI OCRが数式、表、テキストを抽出します。
変換: 必要に応じて元のPDFと比較しながらWord、LaTeX、HTML、またはMarkdownにエクスポートします。
翻訳: 選択したAIエンジンでバイリンガル翻訳を実行します(オプション)。
スケール: バッチ処理またはAPIを使用して大量のデータを処理します。
Doc2Xの使用例
- 学術研究
- 教育
- 財務および基準
- RAGおよびモデルトレーニング
- 国際的なコラボレーション


