Ubah format dokumen
Buat PDF bisa dicari dengan OCR
Kenali teks hasil scan dalam 100+ bahasa tanpa mengubah tampilan halamannya.
Pilih file
Pilih satu PDF hasil scan dengan maksimal 80 halaman atau 120 MB.
Cara kerjanya
- 1
Pilih PDF hasil scan, lalu tentukan bahasa yang tercetak di dokumen itu.
- 2
Rebuild mengenali halaman yang hanya berupa gambar dan membiarkan halaman yang teksnya sudah bisa dicari.
- 3
Lapisan teks Unicode dan setiap halaman hasil diperiksa secara terpisah sebelum diunduh.
Pertanyaan umum
Apa itu OCR, dan kapan saya butuh?
OCR membaca tulisan di halaman hasil scan lalu menambahkan lapisan teks tak terlihat di atasnya, sehingga PDF hasil pindai bisa dicari dan disalin. OCR dibutuhkan kalau teks di PDF tidak bisa diseleksi atau tidak ketemu saat dicari.
Bahasa apa saja yang didukung?
Tersedia lebih dari 100 model bahasa dari registri Tesseract saat ini, termasuk bahasa Indonesia, Inggris, Arab, Tionghoa, Jepang, Korea, aksara India, dan varian historisnya.
Apakah tampilan PDF akan berubah?
Tidak. OCR menambahkan teks Unicode tak terlihat yang bisa dicari di atas halaman asli, bukan membangun ulang tampilan halamannya.
Apakah halaman dokumen saya ikut di-upload saat OCR?
Tidak ada halaman dokumen yang dikirim ke server. Paket pengenalan teks yang dipilih diunduh dan disimpan di perangkat, lalu OCR berjalan di browser ini.