본문으로 건너뛰기
ToolPotion

OCR - 이미지 리더

이 Chrome 확장 프로그램은 내부 OCR 엔진을 사용하여 이미지를 캡처하고 텍스트로 변환합니다. 100개 이상의 언어, 자동 방향 및 스크립트 감지를 지원합니다. 이 도구는 OCR을 오프라인으로 처리하여 다양한 문서 유형 및 웹 페이지에 대한 유연성을 제공하며, 정확도 향상을 위해 수정된 이미지로 다시 시도할 수 있는 옵션이 있습니다.

URL 방문

설명

OCR - 이미지 리더는 Chrome용 강력한 광학 문자 인식(OCR) 확장 프로그램으로, 이미지를 캡처하여 편집 가능한 텍스트로 변환하도록 설계되었습니다. 설치 시 브라우저에 도구 모음 버튼이 추가됩니다. 활성화되면 사용자는 OCR 처리를 위해 활성 창 내의 특정 영역을 선택할 수 있습니다.

이 확장 프로그램은 "tesseract.js" 라이브러리를 통해 통합된 Tesseract OCR 엔진을 사용하며, 100개 이상의 언어를 지원합니다. 주요 기능에는 자동 텍스트 방향 감지 및 스크립트 인식이 포함되어 다양한 텍스트 소스에 대한 정확성과 사용성을 향상시킵니다. 라이브러리는 필요에 따라 로드되고 사용 후 제거되어 장기적인 리소스 소비를 방지합니다.

두 가지 OCR 엔진을 사용할 수 있습니다. 서식을 유지하지 않고 일반 텍스트를 추출하는 Tesseract와 제목, 목록, 스타일(굵게, 기울임꼴), 표 및 수학 방정식을 해석할 수 있는 IBM Granite-Docling입니다. OCR 프로세스의 본질적인 느린 속도로 인해 이 확장 프로그램은 감지 중에 진행률 표시줄을 제공합니다. 중요하게도, 언어 학습 데이터의 초기 다운로드를 제외하고는 모든 OCR 처리가 오프라인으로 수행되며 서버 측 상호 작용은 없습니다.

이 도구는 다용도로 사용할 수 있으며, 사용자는 이미지, PDF 문서, PowerPoint 슬라이드 또는 콘텐츠 선택이 제한될 수 있는 웹 페이지에서도 텍스트를 추출할 수 있습니다. 정확도 향상을 위해 이 확장 프로그램에는 이미지를 반전하고 OCR을 다시 시도하는 기능이 포함되어 있으며, 이는 특히 어두운 테마 인터페이스에 유용합니다. 초기 추출 신뢰도가 낮은 경우 사용자는 이미지를 수동으로 수정하고 다시 업로드하여 다시 시도할 수 있습니다.

버전 0.2.4에서는 브라우저 수준 페이지 확대/축소 및 OS 수준 화면 확대/축소 지원과 함께 베타 수준의 이미지 언어 감지가 도입되었습니다. 이 확장 프로그램은 brian.girko에서 제공하며 243명의 사용자로부터 5점 만점에 4.1점을 획득하여 OCR 기능에 대해 전반적으로 긍정적인 평가를 받고 있음을 나타냅니다.

OCR의 핵심 기능

  • 이미지-텍스트 변환을 위한 광학 문자 인식(OCR)

  • 내부 OCR 엔진(tesseract.js를 통한 Tesseract)

  • 100개 이상의 언어 지원

  • 자동 텍스트 방향 및 스크립트 감지

  • 오프라인 OCR 처리

  • Tesseract(일반 텍스트) 및 IBM Granite-Docling(서식 있는 텍스트) 엔진 선택

  • 정확도 향상을 위한 이미지 반전 및 다시 시도 옵션

  • 이미지, PDF 및 PowerPoint 슬라이드에서 텍스트 추출 기능

  • 콘텐츠 선택이 제한된 웹 페이지에서 텍스트 추출

  • JS 라이브러리의 온디맨드 로딩 및 언로딩

  • 감지 모듈용 진행률 표시줄

  • 브라우저 및 OS 수준 확대/축소 지원

  • 베타 이미지 언어 감지

OCR 사용 방법은?

  1. Chrome 웹 스토어에서 OCR - 이미지 리더 확장 프로그램을 설치합니다.

  2. 확장 프로그램의 도구 모음 버튼을 클릭하여 활성화합니다.

  3. 이미지 또는 문서가 포함된 화면의 원하는 영역을 선택합니다.

  4. 확장 프로그램이 해당 영역을 캡처하고 OCR 처리를 수행합니다.

  5. 추출된 텍스트의 정확성을 검토합니다.

  6. 필요한 경우 이미지를 수정하고 다시 업로드하여 OCR을 다시 시도합니다.

OCR의 사용 사례

  • 이미지에서 텍스트 추출
  • 문서 디지털화
  • PDF 콘텐츠 처리
  • 웹 페이지 텍스트 캡처
  • 프레젠테이션 슬라이드 분석
  • 접근성 향상
  • 데이터 입력 자동화

OCR의 FAQ

OCR 리뷰

로딩 중...

OCR와(과) 비슷한 인기 AI 도구

이미지를 텍스트로 변환 (OCR)은 이미지와 PDF를 편집 가능한 텍스트로 변환하는 Chrome 확장 프로그램입니다. 빠른 스캔, 100개 이상의 언어에 대한 다국어 지원, 웹페이지에서 직접 텍스트를 쉽게 추출할 수 있는 컨텍스트 메뉴 통합 기능을 제공합니다. 또한 화면 자르기, 추출된 텍스트의 오디오 재생,…

컴퓨터 비전 도구

AI 모바일 앱

이 Chrome 확장 프로그램은 OCR 기술을 활용하여 JPG 이미지에서 텍스트를 추출합니다. 활성 탭의 이미지를 JPG 형식으로 변환한 다음 처리하여 편집 가능한 텍스트를 검색합니다. 이 도구는 시각적 소스의 텍스트를 효율적으로 디지털화해야 하는 사용자를 위해 설계되었습니다.

컴퓨터 비전 도구

AI 모바일 앱

Pic to Text는 이미지와 웹페이지에서 텍스트를 추출하는 OCR Chrome 확장 프로그램입니다. 여러 언어를 지원하며 사진을 편집 가능한 텍스트로 빠르고 정확하게 변환합니다. 시각적 소스의 정보를 수동으로 입력하지 않고 디지털화해야 하는 학생 및 전문가에게 이상적입니다.

컴퓨터 비전 도구

ReadImage는 웹 페이지의 이미지에서 직접 텍스트를 추출할 수 있는 Chrome 확장 프로그램입니다. 일반적인 이미지 형식을 지원하며 편집 및 복사 기능을 제공하여 다양한 작업을 위해 온라인 시각 콘텐츠에서 정보를 얻는 과정을 간소화합니다.

컴퓨터 비전 도구

이 Chrome 확장 프로그램은 사용자가 스크린샷을 찍어 이미지에서 텍스트를 추출할 수 있도록 합니다. Baidu 및 Google을 사용하여 인식된 텍스트를 검색하는 것을 지원하여 다양한 시각적 데이터 소스의 정보 검색 및 콘텐츠 분석을 간소화합니다.

컴퓨터 비전 도구

이 Chrome 확장 프로그램은 이미지를 텍스트로 빠르게 변환하여 ChatGPT 입력란에 직접 채워줍니다. 드래그 앤 드롭 업로드, 클립보드 붙여넣기를 지원하며 개인 정보 보호 강화를 위해 OCR을 로컬에서 처리합니다. 이미지에서 텍스트를 가져와 ChatGPT에 입력하는 워크플로우를 간소화하여 빠르고 직관적인 솔루션을…

컴퓨터 비전 도구

AI 모바일 앱

hahaOCR는 이미지에서 텍스트를 추출하여 편집 가능한 텍스트로 변환하는 Chrome 확장 프로그램입니다. 사용자는 버튼 클릭으로 이미지를 업로드하고 'ESC' 키로 애플리케이션을 종료할 수 있습니다. 인식된 텍스트는 쉽게 복사하고 사용할 수 있도록 텍스트 영역에 표시됩니다.

컴퓨터 비전 도구

AI 프레임워크

Tesseract OCR은 강력한 오픈 소스 광학 문자 인식 엔진입니다. 다양한 언어를 지원하며 이미지에서 텍스트를 추출하는 데 사용할 수 있습니다. 이 문서는 개발자와 사용자를 위한 사용자 매뉴얼 및 소스 코드 세부 정보를 제공합니다.

컴퓨터 비전 도구