Ubah format dokumen

Buat PDF bisa dicari dengan OCR

Kenali teks hasil scan dalam 100+ bahasa tanpa mengubah tampilan halamannya.

File tetap di perangkat Anda

Pilih file

Pilih satu PDF hasil scan dengan maksimal 80 halaman atau 120 MB.

atau tarik dan lepas di siniBerjalan di perangkat iniTanpa upload

Cara kerjanya

  1. 1

    Pilih PDF hasil scan, lalu tentukan bahasa yang tercetak di dokumen itu.

  2. 2

    Rebuild mengenali halaman yang hanya berupa gambar dan membiarkan halaman yang teksnya sudah bisa dicari.

  3. 3

    Lapisan teks Unicode dan setiap halaman hasil diperiksa secara terpisah sebelum diunduh.

Pertanyaan umum

Apa itu OCR, dan kapan saya butuh?

OCR membaca tulisan di halaman hasil scan lalu menambahkan lapisan teks tak terlihat di atasnya, sehingga PDF hasil pindai bisa dicari dan disalin. OCR dibutuhkan kalau teks di PDF tidak bisa diseleksi atau tidak ketemu saat dicari.

Bahasa apa saja yang didukung?

Tersedia lebih dari 100 model bahasa dari registri Tesseract saat ini, termasuk bahasa Indonesia, Inggris, Arab, Tionghoa, Jepang, Korea, aksara India, dan varian historisnya.

Apakah tampilan PDF akan berubah?

Tidak. OCR menambahkan teks Unicode tak terlihat yang bisa dicari di atas halaman asli, bukan membangun ulang tampilan halamannya.

Apakah halaman dokumen saya ikut di-upload saat OCR?

Tidak ada halaman dokumen yang dikirim ke server. Paket pengenalan teks yang dipilih diunduh dan disimpan di perangkat, lalu OCR berjalan di browser ini.