Description
OCR - Image Reader est une puissante extension de reconnaissance optique de caractères (OCR) pour Chrome, conçue pour capturer et convertir des images en texte éditable. Après l'installation, elle ajoute un bouton de barre d'outils à votre navigateur. Lorsqu'il est activé, les utilisateurs peuvent sélectionner une région spécifique dans la fenêtre active pour le traitement OCR.
L'extension utilise le moteur OCR Tesseract, intégré via la bibliothèque "tesseract.js", qui prend en charge plus de 100 langues. Les fonctionnalités clés incluent la détection automatique de l'orientation du texte et la reconnaissance des scripts, améliorant la précision et l'utilisabilité sur diverses sources de texte. La bibliothèque est chargée à la demande et supprimée après utilisation, garantissant aucune consommation de ressources à long terme.
Deux moteurs OCR sont disponibles : Tesseract, qui extrait du texte brut sans préserver la mise en forme, et IBM Granite-Docling, capable d'interpréter les titres, les listes, les styles (gras, italique), les tableaux et les équations mathématiques. L'extension affiche une barre de progression pendant la détection en raison de la lenteur inhérente aux processus OCR. Il est important de noter que tout le traitement OCR est effectué hors ligne, sans interaction côté serveur, à l'exception du téléchargement initial des données d'entraînement linguistiques.
Cet outil est polyvalent, permettant aux utilisateurs d'extraire du texte d'images, de documents PDF, de diapositives PowerPoint, ou même de pages Web où la sélection de contenu peut être restreinte. Pour une meilleure précision, l'extension inclut une fonctionnalité pour inverser les images et réessayer l'OCR, ce qui est particulièrement bénéfique pour les interfaces à thème sombre. Les utilisateurs peuvent également modifier manuellement les images et les re-télécharger pour une autre tentative si la confiance initiale d'extraction est faible.
La version 0.2.4 a introduit la prise en charge du zoom de page au niveau du navigateur et du zoom d'écran au niveau du système d'exploitation, ainsi que la détection de langue d'image au niveau bêta. L'extension est proposée par brian.girko et a obtenu une note de 4,1 sur 5 de la part de 243 utilisateurs, indiquant une réception généralement positive pour ses capacités OCR.
Fonctionnalités principales de OCR
Reconnaissance optique de caractères (OCR) pour la conversion d'images en texte
Moteur OCR interne (Tesseract via tesseract.js)
Prend en charge plus de 100 langues
Orientation automatique du texte et détection de script
Traitement OCR hors ligne
Choix entre les moteurs Tesseract (texte brut) et IBM Granite-Docling (texte formaté)
Option d'inversion d'image et de réessai pour une meilleure précision
Capacité d'extraire du texte d'images, de PDF et de diapositives PowerPoint
Extrait du texte de pages Web avec sélection de contenu restreinte
Chargement et déchargement à la demande de la bibliothèque JS
Barre de progression pour les modules de détection
Prise en charge du zoom au niveau du navigateur et du système d'exploitation
Détection d'image linguistique bêta
Comment utiliser OCR ?
Installez l'extension OCR - Image Reader depuis le Chrome Web Store.
Cliquez sur le bouton de la barre d'outils de l'extension pour l'activer.
Sélectionnez la région souhaitée sur votre écran contenant l'image ou le document.
L'extension capturera la zone et effectuera le traitement OCR.
Vérifiez l'exactitude du texte extrait.
Si nécessaire, modifiez l'image et re-téléchargez-la pour une autre tentative OCR.
Cas d'utilisation de OCR
- Extraire du texte d'images
- Numériser des documents
- Traiter le contenu PDF
- Capturer du texte de pages Web
- Analyser des diapositives de présentation
- Améliorer l'accessibilité
- Automatisation de la saisie de données







