OCR PDF
Jadikan PDF imbasan boleh dicari dan disalin.
Berjalan sepenuhnya dalam pelayar anda. Sahkan dalam tab rangkaian anda.
Memilih bahasa halaman sahaja lebih cepat dan tepat sedikit.
Apa yang dilakukan
Setiap halaman dilukis pada kira-kira 300 dpi dan dibaca oleh Tesseract, yang berjalan dalam pelayar anda, dalam Bahasa Inggeris, Melayu atau kedua-duanya. Perkataan diletakkan di atas halaman asal sebagai teks tidak kelihatan, seperti yang dilakukan pengimbas, jadi halaman kelihatan sama tetapi kini boleh dicari, dipilih dan disalin. Teks yang dikenal pasti turut dipaparkan, sedia untuk disalin.
Had
- Penggunaan pertama memuat turun enjin OCR dan data bahasa sekali, kira-kira 15 MB, dari laman ini.
- Ketepatan bergantung pada imbasan: halaman yang senget, kabur, beresolusi rendah atau tulisan tangan dibaca dengan buruk.
- Jadual dan lajur keluar sebagai baris teks biasa dalam salinan, walaupun lapisan tidak kelihatan terletak di atas perkataan yang betul.
- Dokumen besar mengambil masa: kira-kira beberapa saat setiap halaman.
Adakah ini peribadi?
Ya, dan anda boleh menyemaknya sendiri. Buka tab rangkaian (network) pelayar anda dan jalankan alat ini: fail anda tidak pernah muncul di situ, kerana tiada pelayan untuk dihantar. Seluruh laman ini hanyalah fail statik, serta enjin WebAssembly yang melakukan kerja, yang disediakan dari domain yang sama.