Belge dönüştürme

Taranmış PDF'ye OCR ekleyin

Taranmış sayfalara 100'den fazla dilde aranabilir metin katmanı ekleyin.

Bir dosya seçin

En fazla 80 sayfa veya 120 MB boyutunda taranmış bir PDF seçin.

veya buraya sürükleyip bırakınBu cihazda çalışırDosya yüklenmez

Taranmış PDF'ye aranabilir metin ekleyin

Taranmış sayfalardaki basılı metni tanıyın ve PDF'ye görünmez bir arama katmanı ekleyin. Görünen sayfa korunur; sonuçta metin arama, seçme, kopyalama ve dizinleme kullanılabilir.

Sayfa görüntüsünü koruyun

Aranabilir PDF, her sayfanın görüntüsünü korur ve arkasına görünmez bir metin katmanı ekler. Sayfanın görünümü değişmez; metin aranabilir, seçilebilir ve kopyalanabilir. Sayfayı yeniden görüntüleyen OCR işlemleri, metin katmanını eklerken netliği veya renkleri değiştirebilir.

Kaynak sayfa görüntüleri yeniden oluşturulmadan çıktıya kopyalanır. Tanınan metin, bulunduğu konuma satır satır eklenir; görünen sayfa görüntüsü yerinde kalır.

Metin tanıma

Tanıma gereken her sayfa, uzun kenarında 3.200 piksele kadar çözünürlükte işlenir; bu, sekiz puntoluk dipnotların bile harf biçimlerini ayırt edilebilir tutacak yüksekliktir. Telefonla çekilmiş belgelerde tanıma, düzensiz ışığın harfleri birbirine bulaştırmaması için arka planı normalleştirilmiş bir kopyadan okur; o kopya yalnızca okuma içindir ve çıktınızda asla yer almaz.

Tanıma, web tarayıcınızın içinde çalışacak biçimde derlenmiş Tesseract motoruyla yapılır. Belgenin alfabesi ve dili otomatik algılanır; isterseniz Arapça ve İbranice gibi sağdan sola yazılan diller dahil yüzden fazla tanıma dili arasından seçim yapabilirsiniz. Seçilebilir metin içeren sayfalar değiştirilmez. Özet, tanınan sayfaları ve daha önce metin içeren sayfaları listeler.

Çıktıyı indirmeden önce kontrol edin

İşlem tamamlandığında araç oluşturulan PDF'yi yeniden açar ve sonucu kontrol eder. Sayfa sayısı kaynak dosyayla aynı olmalı; her sayfanın boyutu ve dönüşü puntonun yüzde biri içinde eşleşmeli; dosyada daha önce bulunan ve yeni tanınan metin satırları çıktıda aranabilmelidir. Ardından sayfalar yeniden görüntülenir ve kaynak sayfaların görünümüyle karşılaştırılır. Bu kontrollerden biri başarısız olursa dosya indirmeye sunulmaz.

Dijital imzalı bir PDF'ye OCR eklemek imzayı geçersiz kılacağından işlem başlatılmaz. Bütün sayfalarda zaten seçilebilir metin varsa yeni bir kopya oluşturulmaz; mevcut dosyayı kullanabilirsiniz.

Aranabilir arşiv için dosyaları hazırlayın

Tek işlemde en fazla 80 sayfa kabul edilir; bu sınır tarayıcıdaki bellek kullanımını sınırlar. Daha uzun arşivleri ayrı gruplar hâlinde işleyin. Gerekli dil paketi indirildikten sonra tanıma cihazda çalışır; seçtiğiniz belge işleme sunucusuna gönderilmez.

Aranabilir PDF'lerden oluşan bir klasör, işletim sistemi, belge yönetim sistemi veya masaüstü arama uygulaması tarafından dizinlenebilir. Arşivlemeden önce adları, tarihleri, referans numaralarını ve diğer kritik metinleri sayfa görüntüsüyle karşılaştırın.

Belgeyi cihazınızda işleyin

Seçtiğiniz dosya bu tarayıcıda açılır. Sayfaları görüntüleme, metni tanıma, görünmez metin katmanını yerleştirme ve çıktıyı kontrol etme işlemleri cihazınızda yapılır. Belgenin kendisi, dosya adı ve tanınan metin işlenmek üzere bir sunucuya gönderilmez. Gerekli OCR dil dosyası ağ üzerinden indirilebilir; bu isteğin içinde belgeniz yer almaz.

Sorular
OCR ne zaman kullanılır?

PDF'deki yazıyı seçemiyor veya aramayla bulamıyorsanız OCR kullanabilirsiniz. Araç, taranmış sayfanın üzerine görünmez bir metin katmanı ekler; sayfa görüntüsü yerinde kalır.

Hangi diller destekleniyor?

Tesseract dil paketleriyle 100'den fazla dil kullanılabilir. Türkçe, Arapça, Hint yazıları, Çince, Japonca, Korece ve bazı tarihî yazı çeşitleri desteklenir.

PDF'nin görünümü değişir mi?

OCR sayfa görüntüsünü yeniden oluşturmaz. Görüntünün üzerine görünmez ve aranabilir bir Unicode metin katmanı ekler; mevcut metin korunur.

OCR nerede çalışır?

Seçtiğiniz dil paketi indirilip önbelleğe alınır. Belge sayfaları ve metin tanıma işlemi bu tarayıcıda kalır.