Beschreibung
OCR - Bildleser ist eine leistungsstarke Optical Character Recognition (OCR)-Erweiterung für Chrome, die dazu dient, Bilder zu erfassen und in bearbeitbaren Text umzuwandeln. Nach der Installation fügt sie eine Symbolleistenschaltfläche zu Ihrem Browser hinzu. Wenn sie aktiviert ist, können Benutzer einen bestimmten Bereich im aktiven Fenster für die OCR-Verarbeitung auswählen.
Die Erweiterung verwendet die Tesseract OCR-Engine, die über die "tesseract.js"-Bibliothek integriert ist und über 100 Sprachen unterstützt. Zu den Hauptmerkmalen gehören die automatische Erkennung der Textausrichtung und die Skripterkennung, was die Genauigkeit und Benutzerfreundlichkeit bei verschiedenen Textquellen verbessert. Die Bibliothek wird bei Bedarf geladen und nach Gebrauch entfernt, um sicherzustellen, dass keine langfristige Ressourcenbeanspruchung erfolgt.
Zwei OCR-Engines sind verfügbar: Tesseract, das einfachen Text extrahiert, ohne die Formatierung beizubehalten, und IBM Granite-Docling, das Überschriften, Listen, Stile (fett, kursiv), Tabellen und mathematische Gleichungen interpretieren kann. Die Erweiterung zeigt aufgrund der inhärenten Langsamkeit von OCR-Prozessen einen Fortschrittsbalken während der Erkennung an. Wichtig ist, dass die gesamte OCR-Verarbeitung offline erfolgt, ohne Server-seitige Interaktion, mit Ausnahme des anfänglichen Downloads von Sprach-Trainingsdaten.
Dieses Tool ist vielseitig und ermöglicht es Benutzern, Text aus Bildern, PDF-Dokumenten, PowerPoint-Folien oder sogar Webseiten zu extrahieren, auf denen die Inhaltsauswahl eingeschränkt sein kann. Zur Verbesserung der Genauigkeit enthält die Erweiterung eine Funktion zum Invertieren von Bildern und zum erneuten Versuch der OCR, was besonders für dunkle Benutzeroberflächen nützlich ist. Benutzer können auch Bilder manuell ändern und sie erneut hochladen, wenn die anfängliche Extraktionssicherheit niedrig ist.
Version 0.2.4 führte die Unterstützung für Browser-seitiges Seiten-Zooming und OS-seitiges Bildschirm-Zooming ein, zusammen mit der Bildsprachenerkennung auf Beta-Ebene. Die Erweiterung wird von brian.girko angeboten und hat eine Bewertung von 4,1 von 5 Sternen von 243 Benutzern erhalten, was auf eine allgemein positive Aufnahme ihrer OCR-Fähigkeiten hinweist.
OCR's Kernfunktionen
Optical Character Recognition (OCR) zur Bild-zu-Text-Konvertierung
Interne OCR-Engine (Tesseract über tesseract.js)
Unterstützt über 100 Sprachen
Automatische Textausrichtung und Skripterkennung
Offline-OCR-Verarbeitung
Wahl zwischen Tesseract (einfacher Text) und IBM Granite-Docling (formatierter Text) Engines
Bildinversion und Wiederholungsoption zur Verbesserung der Genauigkeit
Fähigkeit, Text aus Bildern, PDFs und PowerPoint-Folien zu extrahieren
Extrahiert Text aus Webseiten mit eingeschränkter Inhaltssauswahl
On-Demand-Laden und Entladen der JS-Bibliothek
Fortschrittsbalken für Erkennungsmodule
Unterstützung für Browser- und OS-seitiges Zoomen
Beta-Bildsprachenerkennung
Wie verwendet man OCR?
Installieren Sie die OCR - Bildleser-Erweiterung aus dem Chrome Web Store.
Klicken Sie auf die Symbolleistenschaltfläche der Erweiterung, um sie zu aktivieren.
Wählen Sie den gewünschten Bereich auf Ihrem Bildschirm aus, der das Bild oder Dokument enthält.
Die Erweiterung erfasst den Bereich und führt die OCR-Verarbeitung durch.
Überprüfen Sie den extrahierten Text auf Genauigkeit.
Bei Bedarf ändern Sie das Bild und laden Sie es erneut hoch, um einen weiteren OCR-Versuch durchzuführen.
OCR's Anwendungsfälle
- Text aus Bildern extrahieren
- Dokumente digitalisieren
- PDF-Inhalte verarbeiten
- Webseiten-Text erfassen
- Präsentationsfolien analysieren
- Barrierefreiheit verbessern
- Daten-Eingabeautomatisierung







