Zum Hauptinhalt springen
ToolPotion

OCR - Bildleser

Diese Chrome-Erweiterung erfasst und konvertiert Bilder mit einer internen OCR-Engine in Text. Sie unterstützt über 100 Sprachen, automatische Ausrichtung und Skripterkennung. Das Tool verarbeitet OCR offline und bietet Flexibilität für verschiedene Dokumenttypen und Webseiten, mit Optionen zum erneuten Versuch mit modifizierten Bildern zur Verbesserung der Genauigkeit.

URL besuchen

Beschreibung

OCR - Bildleser ist eine leistungsstarke Optical Character Recognition (OCR)-Erweiterung für Chrome, die dazu dient, Bilder zu erfassen und in bearbeitbaren Text umzuwandeln. Nach der Installation fügt sie eine Symbolleistenschaltfläche zu Ihrem Browser hinzu. Wenn sie aktiviert ist, können Benutzer einen bestimmten Bereich im aktiven Fenster für die OCR-Verarbeitung auswählen.

Die Erweiterung verwendet die Tesseract OCR-Engine, die über die "tesseract.js"-Bibliothek integriert ist und über 100 Sprachen unterstützt. Zu den Hauptmerkmalen gehören die automatische Erkennung der Textausrichtung und die Skripterkennung, was die Genauigkeit und Benutzerfreundlichkeit bei verschiedenen Textquellen verbessert. Die Bibliothek wird bei Bedarf geladen und nach Gebrauch entfernt, um sicherzustellen, dass keine langfristige Ressourcenbeanspruchung erfolgt.

Zwei OCR-Engines sind verfügbar: Tesseract, das einfachen Text extrahiert, ohne die Formatierung beizubehalten, und IBM Granite-Docling, das Überschriften, Listen, Stile (fett, kursiv), Tabellen und mathematische Gleichungen interpretieren kann. Die Erweiterung zeigt aufgrund der inhärenten Langsamkeit von OCR-Prozessen einen Fortschrittsbalken während der Erkennung an. Wichtig ist, dass die gesamte OCR-Verarbeitung offline erfolgt, ohne Server-seitige Interaktion, mit Ausnahme des anfänglichen Downloads von Sprach-Trainingsdaten.

Dieses Tool ist vielseitig und ermöglicht es Benutzern, Text aus Bildern, PDF-Dokumenten, PowerPoint-Folien oder sogar Webseiten zu extrahieren, auf denen die Inhaltsauswahl eingeschränkt sein kann. Zur Verbesserung der Genauigkeit enthält die Erweiterung eine Funktion zum Invertieren von Bildern und zum erneuten Versuch der OCR, was besonders für dunkle Benutzeroberflächen nützlich ist. Benutzer können auch Bilder manuell ändern und sie erneut hochladen, wenn die anfängliche Extraktionssicherheit niedrig ist.

Version 0.2.4 führte die Unterstützung für Browser-seitiges Seiten-Zooming und OS-seitiges Bildschirm-Zooming ein, zusammen mit der Bildsprachenerkennung auf Beta-Ebene. Die Erweiterung wird von brian.girko angeboten und hat eine Bewertung von 4,1 von 5 Sternen von 243 Benutzern erhalten, was auf eine allgemein positive Aufnahme ihrer OCR-Fähigkeiten hinweist.

OCR's Kernfunktionen

  • Optical Character Recognition (OCR) zur Bild-zu-Text-Konvertierung

  • Interne OCR-Engine (Tesseract über tesseract.js)

  • Unterstützt über 100 Sprachen

  • Automatische Textausrichtung und Skripterkennung

  • Offline-OCR-Verarbeitung

  • Wahl zwischen Tesseract (einfacher Text) und IBM Granite-Docling (formatierter Text) Engines

  • Bildinversion und Wiederholungsoption zur Verbesserung der Genauigkeit

  • Fähigkeit, Text aus Bildern, PDFs und PowerPoint-Folien zu extrahieren

  • Extrahiert Text aus Webseiten mit eingeschränkter Inhaltssauswahl

  • On-Demand-Laden und Entladen der JS-Bibliothek

  • Fortschrittsbalken für Erkennungsmodule

  • Unterstützung für Browser- und OS-seitiges Zoomen

  • Beta-Bildsprachenerkennung

Wie verwendet man OCR?

  1. Installieren Sie die OCR - Bildleser-Erweiterung aus dem Chrome Web Store.

  2. Klicken Sie auf die Symbolleistenschaltfläche der Erweiterung, um sie zu aktivieren.

  3. Wählen Sie den gewünschten Bereich auf Ihrem Bildschirm aus, der das Bild oder Dokument enthält.

  4. Die Erweiterung erfasst den Bereich und führt die OCR-Verarbeitung durch.

  5. Überprüfen Sie den extrahierten Text auf Genauigkeit.

  6. Bei Bedarf ändern Sie das Bild und laden Sie es erneut hoch, um einen weiteren OCR-Versuch durchzuführen.

OCR's Anwendungsfälle

  • Text aus Bildern extrahieren
  • Dokumente digitalisieren
  • PDF-Inhalte verarbeiten
  • Webseiten-Text erfassen
  • Präsentationsfolien analysieren
  • Barrierefreiheit verbessern
  • Daten-Eingabeautomatisierung

FAQ von OCR

OCR Bewertungen

Wird geladen...

Beliebte KI-Tools wie OCR

KI-Mobile-Apps

Bild zu Text (OCR) ist eine Chrome-Erweiterung, die Bilder und PDFs in bearbeitbaren Text umwandelt. Sie bietet schnelles Scannen, mehrsprachige Unterstützung für über 100…

Computer-Vision-Tools

KI-Mobile-Apps

Diese Chrome-Erweiterung nutzt OCR-Technologie, um Text aus JPG-Bildern zu extrahieren. Sie konvertiert Bilder aus dem aktiven Tab in das JPG-Format und verarbeitet sie dann, um…

Computer-Vision-Tools

KI-Mobile-Apps

Pic to Text ist eine OCR-Chrome-Erweiterung, die Text aus Bildern und Webseiten extrahiert. Sie wandelt Bilder schnell und präzise in bearbeitbaren Text um und unterstützt mehrere…

Computer-Vision-Tools

ReadImage ist eine Chrome-Erweiterung, mit der Benutzer Text direkt aus Bildern auf Webseiten extrahieren können. Sie unterstützt gängige Bildformate und bietet Bearbeitungs- und…

Computer-Vision-Tools

KI-Mobile-Apps

Diese Chrome-Erweiterung ermöglicht es Benutzern, Text aus Bildern zu extrahieren, indem sie Screenshots erstellen. Sie unterstützt die Suche nach dem erkannten Text über Baidu…

Computer-Vision-Tools

Diese Chrome-Erweiterung konvertiert Bilder schnell in Text und füllt direkt Ihr ChatGPT-Textfeld. Sie unterstützt Drag-and-Drop-Uploads, das Einfügen aus der Zwischenablage und…

Computer-Vision-Tools

KI-Mobile-Apps

hahaOCR ist eine Chrome-Erweiterung, die Text aus Bildern extrahiert und in bearbeitbaren Text umwandelt. Benutzer können Bilder per Knopfdruck hochladen und die Anwendung mit der…

Computer-Vision-Tools

KI-Frameworks

Tesseract OCR ist eine leistungsstarke Open-Source-Engine für optische Zeichenerkennung. Sie unterstützt eine Vielzahl von Sprachen und kann zum Extrahieren von Text aus Bildern…

Computer-Vision-Tools