Ubah format dokumen
OCR PDF hasil scan
Tambahkan lapisan teks yang bisa dicari ke PDF hasil scan dalam lebih dari 100 bahasa.
Pilih file
Pilih satu PDF hasil scan dengan maksimal 80 halaman atau 120 MB.
Buat PDF hasil scan bisa dicari
OCR menambahkan lapisan teks ke halaman gambar. Tampilan PDF tetap berasal dari hasil scan, sedangkan teks di belakangnya dapat dicari, dipilih, dan disalin.
Periksa apakah OCR memang diperlukan
Buka PDF, cari satu kata yang terlihat, lalu coba pilih satu kalimat. Jika pencarian berhasil dan pilihan mengikuti kata satu per satu, halaman sudah memiliki teks. OCR tidak perlu dijalankan lagi pada halaman tersebut. Rebuild mempertahankan halaman yang sudah berisi teks dan hanya memproses bagian yang belum dikenali.
PDF yang hanya berisi gambar biasanya berasal dari scanner atau kamera. Seluruh halaman terpilih sebagai satu objek dan pencarian tidak menemukan kata apa pun. OCR membuat file seperti ini lebih berguna untuk arsip, pencarian desktop, penyalinan kutipan, dan pemeriksaan isi. OCR tidak otomatis membuat tata letak dapat diedit atau menjadikan dokumen aksesibel.
Pilih bahasa dan jalankan pengenalan
Pilih satu PDF hasil scan dengan maksimal 80 halaman atau 120 MB. Deteksi otomatis tersedia, atau pilih bahasa dokumen dari lebih dari 100 paket pengenalan. Pilihan bahasa yang sesuai membantu membedakan bentuk huruf dan tanda baca. Dokumen campuran bahasa, nama orang, kode, tabel, tulisan tangan, dan cetakan samar tetap perlu diperiksa manual.
OCR berjalan di browser. Paket bahasa yang dipilih diunduh ke perangkat, tetapi halaman PDF dan teks hasil pengenalan tidak ikut dalam permintaan tersebut. Gambar halaman tetap menjadi tampilan dokumen; Rebuild menambahkan teks tak terlihat pada posisi yang dikenali. Jika PDF berisi tanda tangan digital, proses dihentikan karena perubahan apa pun pada file dapat membatalkan tanda tangan itu.
Uji teks sebelum memakai hasil OCR
Unduh PDF, lalu buka di aplikasi pembaca lain. Cari nama, tanggal, nomor referensi, dan istilah yang muncul pada beberapa halaman. Salin satu paragraf ke editor teks polos untuk melihat apakah urutan kata mengikuti halaman. Pada dokumen berkolom, periksa agar baris tidak berpindah ke kolom berikutnya terlalu cepat. Pada tabel, cocokkan angka per sel dengan gambar.
Tampilan halaman dapat terlihat benar meskipun lapisan teksnya keliru. Karena itu, jangan menilai hasil OCR hanya dari pratinjau. Simpan PDF sumber secara terpisah, terutama untuk dokumen hukum, keuangan, identitas, atau arsip. Jika satu halaman terlalu buram, buat scan baru dengan posisi lurus dan cahaya merata sebelum mengulang OCR.
Pertanyaan umum
Apa itu OCR, dan kapan saya butuh?
OCR membaca tulisan pada halaman hasil scan dan menambahkan lapisan teks tak terlihat, sehingga PDF hasil pindai bisa dicari dan disalin. Gunakan OCR jika teks di PDF tidak bisa dipilih atau ditemukan.
Bahasa apa saja yang didukung?
Tersedia lebih dari 100 bahasa pengenalan Tesseract, termasuk bahasa Indonesia, Inggris, Arab, Tionghoa, Jepang, dan Korea.
Apakah tampilan PDF akan berubah?
OCR menambahkan lapisan teks tak terlihat di atas gambar halaman. Gambar halaman tetap menjadi tampilan PDF.
Apakah halaman dokumen saya ikut di-upload saat OCR?
Tidak ada halaman dokumen yang dikirim ke server. Paket pengenalan teks yang dipilih diunduh dan disimpan di perangkat, lalu OCR berjalan di browser ini.