Deskripsi
OCR - Pembaca Gambar adalah ekstensi pengenalan karakter optik (OCR) yang kuat untuk Chrome yang dirancang untuk menangkap dan mengonversi gambar menjadi teks yang dapat diedit. Setelah instalasi, ekstensi ini menambahkan tombol bilah alat ke browser Anda. Saat diaktifkan, pengguna dapat memilih wilayah tertentu dalam jendela aktif untuk pemrosesan OCR.
Ekstensi ini menggunakan mesin Tesseract OCR, yang diintegrasikan melalui pustaka "tesseract.js", yang membanggakan dukungan untuk lebih dari 100 bahasa. Fitur-fitur utama meliputi deteksi orientasi teks otomatis dan pengenalan skrip, yang meningkatkan akurasi dan kegunaan di berbagai sumber teks. Pustaka dimuat sesuai permintaan dan dihapus setelah digunakan, memastikan tidak ada konsumsi sumber daya jangka panjang.
Dua mesin OCR tersedia: Tesseract, yang mengekstrak teks biasa tanpa mempertahankan format, dan IBM Granite-Docling, yang mampu menafsirkan judul, daftar, gaya (tebal, miring), tabel, dan persamaan matematika. Ekstensi ini menyediakan bilah kemajuan selama deteksi karena lambatnya proses OCR. Yang penting, semua pemrosesan OCR dilakukan secara offline, tanpa interaksi sisi server, kecuali untuk pengunduhan awal data pelatihan bahasa.
Alat ini serbaguna, memungkinkan pengguna untuk mengekstrak teks dari gambar, dokumen PDF, slide PowerPoint, atau bahkan halaman web di mana pemilihan konten mungkin dibatasi. Untuk akurasi yang lebih baik, ekstensi ini menyertakan fitur untuk membalikkan gambar dan mencoba ulang OCR, yang sangat bermanfaat untuk antarmuka bertema gelap. Pengguna juga dapat memodifikasi gambar secara manual dan mengunggahnya kembali untuk upaya lain jika keyakinan ekstraksi awal rendah.
Versi 0.2.4 memperkenalkan dukungan untuk pembesaran halaman tingkat browser dan pembesaran layar tingkat OS, bersama dengan deteksi bahasa gambar tingkat beta. Ekstensi ini ditawarkan oleh brian.girko dan telah mendapatkan peringkat 4,1 dari 5 dari 243 pengguna, yang menunjukkan penerimaan yang umumnya positif untuk kemampuan OCR-nya.
Fitur Inti OCR
Pengenalan Karakter Optik (OCR) untuk konversi gambar ke teks
Mesin OCR internal (Tesseract melalui tesseract.js)
Mendukung lebih dari 100 bahasa
Orientasi teks dan deteksi skrip otomatis
Pemrosesan OCR offline
Pilihan antara mesin Tesseract (teks biasa) dan IBM Granite-Docling (teks terformat)
Opsi inversi gambar dan coba ulang untuk akurasi yang lebih baik
Kemampuan untuk mengekstrak teks dari gambar, PDF, dan slide Powerpoint
Mengekstrak teks dari halaman web dengan pemilihan konten yang dibatasi
Pemuatan dan pembongkaran pustaka JS sesuai permintaan
Bilah kemajuan untuk modul deteksi
Dukungan untuk pembesaran browser dan OS
Deteksi bahasa gambar beta
Cara menggunakan OCR?
Instal ekstensi OCR - Pembaca Gambar dari Chrome Web Store.
Klik tombol bilah alat ekstensi untuk mengaktifkannya.
Pilih wilayah yang diinginkan di layar Anda yang berisi gambar atau dokumen.
Ekstensi akan menangkap area tersebut dan melakukan pemrosesan OCR.
Tinjau teks yang diekstrak untuk akurasi.
Jika perlu, modifikasi gambar dan unggah kembali untuk upaya OCR lainnya.
Kasus Penggunaan OCR
- Ekstrak teks dari gambar
- Digitalisasi dokumen
- Proses konten PDF
- Tangkap teks halaman web
- Analisis slide presentasi
- Tingkatkan aksesibilitas
- Otomatisasi entri data







