Langkau ke kandungan

Imej ke teks (OCR)

Ambil teks daripada gambar dan tangkapan skrin.

Berjalan sepenuhnya dalam pelayar anda. Sahkan dalam tab rangkaian anda.

Memilih bahasa halaman sahaja lebih cepat dan tepat sedikit.

Apa yang dilakukan

Tesseract, enjin OCR sumber terbuka, berjalan dalam pelayar anda dan membaca setiap imej dalam Bahasa Inggeris, Melayu atau kedua-duanya. Gambar telefon ditegakkan dahulu dan tangkapan skrin kecil dibesarkan, yang kedua-duanya membantu. Anda mendapat teks untuk disalin, dan boleh menyimpannya sebagai .txt atau PDF imej dengan teks yang boleh dicari.

Had

  • Penggunaan pertama memuat turun enjin OCR dan data bahasa sekali, kira-kira 15 MB, dari laman ini.
  • Teks bercetak sahaja. Tulisan tangan dibaca dengan buruk atau tidak langsung.
  • Gambar yang lurus, tajam dan terang dibaca jauh lebih baik daripada yang senget atau kabur.
  • Susun atur tidak dikekalkan: lajur dan jadual keluar sebagai baris teks biasa.

Adakah ini peribadi?

Ya, dan anda boleh menyemaknya sendiri. Buka tab rangkaian (network) pelayar anda dan jalankan alat ini: fail anda tidak pernah muncul di situ, kerana tiada pelayan untuk dihantar. Seluruh laman ini hanyalah fail statik, serta enjin WebAssembly yang melakukan kerja, yang disediakan dari domain yang sama.

Alat berkaitan