跳转到主要内容
ToolPotion

OCR - 图片阅读器

这款 Chrome 扩展程序使用内部 OCR 引擎捕获和转换图像为文本。它支持 100 多种语言、自动方向和脚本检测。该工具离线处理 OCR,为各种文档类型和网页提供灵活性,并提供通过修改图像重试以提高准确性的选项。

访问URL

描述

OCR - 图片阅读器是一款强大的 Chrome 光学字符识别 (OCR) 扩展程序,旨在捕获和将图像转换为可编辑文本。安装后,它会在您的浏览器中添加一个工具栏按钮。激活后,用户可以选择活动窗口内的特定区域进行 OCR 处理。

该扩展程序利用 Tesseract OCR 引擎,通过 "tesseract.js" 库集成,该库支持 100 多种语言。主要功能包括自动文本方向检测和脚本识别,从而提高了跨不同文本源的准确性和可用性。该库是按需加载并在使用后移除的,确保没有长期资源消耗。

提供两种 OCR 引擎:Tesseract,它提取纯文本而不保留格式;以及 IBM Granite-Docling,能够解释标题、列表、样式(粗体、斜体)、表格和数学方程式。由于 OCR 过程固有的缓慢,该扩展程序在检测过程中会显示一个进度条。重要的是,所有 OCR 处理均在本地离线进行,没有服务器端交互,除了初始下载语言训练数据。

此工具用途广泛,允许用户从图像、PDF 文档、PowerPoint 幻灯片甚至内容选择可能受限的网页中提取文本。为了提高准确性,该扩展程序包含一个反转图像并重试 OCR 的功能,这对于深色主题界面尤其有用。如果初始提取置信度较低,用户还可以手动修改图像并重新上传以进行另一次尝试。

0.2.4 版本引入了对浏览器级别页面缩放和操作系统级别屏幕缩放的支持,以及 beta 级别的图像语言检测。该扩展程序由 brian.girko 提供,获得了 243 位用户 4.1/5 的评分,表明其 OCR 功能普遍受到好评。

OCR的核心功能

  • 光学字符识别 (OCR),用于图像到文本转换

  • 内部 OCR 引擎 (Tesseract via tesseract.js)

  • 支持 100 多种语言

  • 自动文本方向和脚本检测

  • 离线 OCR 处理

  • Tesseract (纯文本) 和 IBM Granite-Docling (格式化文本) 引擎之间的选择

  • 用于提高准确性的图像反转和重试选项

  • 能够从图像、PDF 和 PowerPoint 幻灯片中提取文本

  • 从内容选择受限的网页中提取文本

  • 按需加载和卸载 JS 库

  • 检测模块的进度条

  • 支持浏览器和操作系统级别的缩放

  • Beta 图像语言检测

如何使用 OCR?

  1. 从 Chrome 网上应用店安装 OCR - 图片阅读器扩展程序。

  2. 点击扩展程序的工具栏按钮以激活它。

  3. 选择屏幕上包含图像或文档的所需区域。

  4. 扩展程序将捕获该区域并执行 OCR 处理。

  5. 检查提取的文本是否准确。

  6. 如有必要,修改图像并重新上传以进行另一次 OCR 尝试。

OCR的使用案例

  • 从图像中提取文本
  • 数字化文档
  • 处理 PDF 内容
  • 捕获网页文本
  • 分析演示文稿幻灯片
  • 提高可访问性
  • 数据录入自动化

OCR的常见问题

OCR 评价

加载中...

与 OCR 类似的热门AI工具

AI 移动应用

图片转文字 (OCR) 是一款 Chrome 扩展程序,可将图片和 PDF 转换为可编辑文本。它提供快速扫描、对 100 多种语言的多语言支持,以及上下文菜单集成,可轻松直接从网页提取文本。该工具还具有屏幕截图、提取文本的音频播放以及链接/电子邮件检测功能。

计算机视觉工具

AI 移动应用

此 Chrome 扩展程序利用 OCR 技术从 JPG 图片中提取文本。它将活动标签页中的图片转换为 JPG 格式,然后进行处理以检索可编辑文本。此工具专为需要高效地将视觉源中的文本数字化的用户而设计。

计算机视觉工具

AI 移动应用

图片转文字是一款OCR Chrome扩展程序,可从图像和网页中提取文本。它能快速准确地将图片转换为可编辑文本,支持多种语言。非常适合需要将视觉信息数字化而无需手动输入文本的学生和专业人士。

计算机视觉工具

ReadImage 是一款 Chrome 扩展程序,用户可以直接从网页上的图像中提取文本。它支持常见的图像格式,并提供编辑和复制功能,从而简化了从在线视觉内容中获取信息的流程,适用于各种任务。

计算机视觉工具

AI 移动应用

这款 Chrome 扩展程序允许用户通过截屏从图片中提取文本。它支持使用百度和谷歌搜索识别出的文本,从而简化了各种视觉数据源的信息检索和内容分析。

计算机视觉工具

这款 Chrome 扩展程序可快速将图像转换为文本,直接填充到您的 ChatGPT 文本框中。它支持拖放上传、剪贴板粘贴,并可在本地处理 OCR 以增强隐私。旨在简化将图像中的文本输入 ChatGPT 的工作流程,提供快速直观的解决方案。

计算机视觉工具

AI 移动应用

hahaOCR 是一款 Chrome 扩展程序,可从图像中提取文本并将其转换为可编辑文本。用户可以通过点击按钮上传图像,并使用“ESC”键退出应用程序。然后,识别出的文本会显示在文本区域中,方便复制和使用。

计算机视觉工具

AI 框架

Tesseract OCR 是一个强大的开源光学字符识别引擎。它支持多种语言,可用于从图像中提取文本。本手册提供用户手册和源代码详细信息,供开发者和用户参考。

计算机视觉工具