メインコンテンツへスキップ
ToolPotion

OCR - 画像リーダー

このChrome拡張機能は、内部OCRエンジンを使用して画像をキャプチャし、テキストに変換します。100以上の言語、自動向き、スクリプト検出をサポートしています。このツールはOCRをオフラインで処理するため、さまざまなドキュメントタイプやウェブページに柔軟に対応でき、精度向上のために画像を修正して再試行するオプションも用意されています。

URLを訪問

説明

OCR - 画像リーダーは、Chrome向けの強力な光学文字認識(OCR)拡張機能で、画像をキャプチャして編集可能なテキストに変換するように設計されています。インストールすると、ブラウザにツールバーボタンが追加されます。アクティブ化されると、ユーザーはOCR処理のためにアクティブウィンドウ内の特定の領域を選択できます。

この拡張機能は、Tesseract OCRエンジンを「tesseract.js」ライブラリ経由で統合しており、100以上の言語をサポートしています。主な機能には、自動的なテキストの向き検出とスクリプト認識が含まれており、多様なテキストソースでの精度と使いやすさを向上させます。ライブラリはオンデマンドでロードされ、使用後に削除されるため、長期的なリソース消費はありません。

2つのOCRエンジンが利用可能です。Tesseractはフォーマットを保持せずにプレーンテキストを抽出します。一方、IBM Granite-Doclingは、見出し、リスト、スタイル(太字、イタリック)、表、数式を解釈できます。OCRプロセスは本質的に遅いため、拡張機能は検出中にプログレスバーを表示します。重要な点として、すべてのOCR処理はオフラインで行われ、サーバーサイドとのやり取りはありません。ただし、言語トレーニングデータの初期ダウンロードは除く。

このツールは多用途で、ユーザーは画像、PDFドキュメント、PowerPointスライド、さらにはコンテンツ選択が制限されている可能性のあるウェブページからテキストを抽出できます。精度を向上させるために、拡張機能には画像を反転させてOCRを再試行する機能が含まれており、これはダークテーマのインターフェースで特に役立ちます。初期抽出の信頼性が低い場合は、ユーザーは手動で画像を修正して再アップロードすることもできます。

バージョン0.2.4では、ブラウザレベルのページズームとOSレベルの画面ズームのサポートが導入され、ベータ版の画像言語検出も追加されました。この拡張機能はbrian.girkoによって提供されており、243人のユーザーから5つ星中4.1の評価を獲得しており、OCR機能に対する全体的に肯定的な評価を示しています。

OCRの主要機能

  • 画像からテキストへの変換のための光学文字認識(OCR)

  • 内部OCRエンジン(tesseract.js経由のTesseract)

  • 100以上の言語をサポート

  • 自動テキスト向きおよびスクリプト検出

  • オフラインOCR処理

  • Tesseract(プレーンテキスト)とIBM Granite-Docling(フォーマット済みテキスト)エンジンの選択

  • 精度向上のための画像反転および再試行オプション

  • 画像、PDF、Powerpointスライドからのテキスト抽出機能

  • コンテンツ選択が制限されているウェブページからのテキスト抽出

  • JSライブラリのオンデマンドロードおよびアンロード

  • 検出モジュールのプログレスバー

  • ブラウザおよびOSレベルのズームサポート

  • ベータ版画像言語検出

OCRの使い方は?

  1. ChromeウェブストアからOCR - 画像リーダー拡張機能をインストールします。

  2. 拡張機能のツールバーボタンをクリックしてアクティブ化します。

  3. 画像またはドキュメントが含まれる画面上の目的の領域を選択します。

  4. 拡張機能が領域をキャプチャし、OCR処理を実行します。

  5. 抽出されたテキストの精度を確認します。

  6. 必要に応じて、画像を修正して再度OCRを試行するために再アップロードします。

OCRの使用例

  • 画像からテキストを抽出する
  • ドキュメントをデジタル化する
  • PDFコンテンツを処理する
  • ウェブページテキストをキャプチャする
  • プレゼンテーションスライドを分析する
  • アクセシビリティを向上させる
  • データ入力自動化

OCRのFAQ

OCR のレビュー

読み込み中...

OCR に似た人気のAIツール

AI モバイルアプリ

画像からテキストへ (OCR) は、画像やPDFを編集可能なテキストに変換するChrome拡張機能です。高速スキャン、100以上の言語に対応した多言語サポート、ウェブページから直接テキストを簡単に抽出できるコンテキストメニュー統合を提供します。また、画面クロッピング、抽出テキストの音声再生、リンク/メール検出機能も備えています。

コンピュータービジョンツール

AI モバイルアプリ

このChrome拡張機能は、OCR技術を利用してJPG画像からテキストを抽出します。アクティブタブの画像をJPG形式に変換し、編集可能なテキストを取得するために処理します。このツールは、視覚的なソースから効率的にテキストをデジタル化する必要があるユーザー向けに設計されています。

コンピュータービジョンツール

AI モバイルアプリ

Pic to Textは、画像やウェブページからテキストを抽出するOCR Chrome拡張機能です。画像を高精度かつ迅速に編集可能なテキストに変換し、多言語に対応しています。視覚的な情報源から手入力なしで情報をデジタル化する必要がある学生や専門家に最適です。

コンピュータービジョンツール

AI モバイルアプリ

ReadImageは、ウェブページ上の画像から直接テキストを抽出できるChrome拡張機能です。一般的な画像形式をサポートし、編集およびコピー機能を提供することで、オンライン上の視覚コンテンツから情報を取得するプロセスを効率化し、さまざまなタスクに役立ちます。

コンピュータービジョンツール

AI モバイルアプリ

このChrome拡張機能を使用すると、ユーザーはスクリーンショットを撮ることで画像からテキストを抽出できます。BaiduおよびGoogleでの認識済みテキストの検索をサポートしており、さまざまなビジュアルデータソースの情報検索とコンテンツ分析を簡素化します。

コンピュータービジョンツール

AI モバイルアプリ

このChrome拡張機能は、画像をテキストに素早く変換し、ChatGPTのテキストボックスに直接入力します。ドラッグ&ドロップアップロード、クリップボードからの貼り付けをサポートし、プライバシーを強化するためにOCRをローカルで処理します。画像からテキストを取得するワークフローを効率化し、高速で直感的なソリューションを提供することを目指しています。

コンピュータービジョンツール

AI モバイルアプリ

hahaOCRは、画像からテキストを抽出し、編集可能なテキストに変換するChrome拡張機能です。ユーザーはボタンクリックで画像をアップロードし、「ESC」キーでアプリケーションを終了できます。認識されたテキストは、コピーして使用しやすいようにテキストエリアに表示されます。

コンピュータービジョンツール

AI フレームワーク

Tesseract OCRは、強力なオープンソースの光学文字認識エンジンです。幅広い言語をサポートし、画像からテキストを抽出するために使用できます。このドキュメントは、開発者およびユーザー向けのユーザーマニュアルとソースコードの詳細を提供します。

コンピュータービジョンツール