Taranmış PDF OCR ile Nasıl Aranabilir Hale Getirilir
Taranmış, yalnızca görüntüden oluşan bir PDF'i OCR ile aranabilir ve kopyalanabilir bir belgeye dönüştürün — birkaç tıkla, kendi dilinizde. Kullanımı ücretsiz, üyelik gerekmez.
Kısa cevap: OCR aracını açın, taramanızı yükleyin, belge dilini seçin ve arayıp kopyalayabileceğiniz bir PDF indirin. Zaten metin içeren sayfalar otomatik olarak atlanır.
Taranmış bir PDF aslında sadece sayfanın bir fotoğrafıdır — metni seçemez, Ctrl+F ile hiçbir şey bulamazsınız. OCR bunu, karakterleri tanıyıp görüntünün arkasına aranabilir bir metin katmanı ekleyerek çözer.
Önce gerçekten OCR gerekip gerekmediğine bakın
PDF'i açın ve fareyle bir metin satırını seçmeyi deneyin:
| Ne oluyor | Ne yapmalı |
|---|---|
| Tek tek kelimeler vurgulanıyor | Hiçbir şey — metin zaten gerçek ve aranabilir |
| Tüm sayfa tek blok halinde seçiliyor | OCR çalıştırın |
| Hiçbir şey seçilmiyor | OCR çalıştırın |
Zaten metni olan bir PDF'e OCR uygulamak zarar vermez ama bir şey de değiştirmez.
PDF'e OCR nasıl uygulanır
- Taranmış PDF'inizi yükleyin — OCR aracına. 50 MB'a kadar dosyalar desteklenir.
- Belgenin dilini seçin — en yüksek doğruluk için; emin değilseniz otomatik seçeneği kullanın.
- Aranabilir PDF'i indirin. Artık Ctrl+F kullanabilir, metni seçebilir ve kopyalayabilirsiniz.
Doğru dili seçmek neden önemli
OCR motorları harf ve kelimeleri tanımak için dile özgü modeller kullanır. Doğru dili seçmek:
- aksanlı karakterlerde (ç, ş, ü, ğ, ı) doğruluğu artırır,
- yanlış okunan kelimeleri azaltır, çünkü sözlük olası olmayan sonuçları düzeltir,
- ve tüm dilleri aynı anda çalıştırmaktan daha hızlıdır.
Belge birden çok dil içeriyorsa otomatik seçenek kurulu tüm dilleri birlikte çalıştırır. Bu, tek bir dil belirtmeye göre daha yavaş ve bir miktar daha az isabetlidir; yalnızca gerektiğinde kullanın.
OCR ne yapar — ne yapmaz
- ✅ Taranmış/fotoğraflanmış PDF'leri aranabilir ve kopyalanabilir yapar.
- ✅ Sayfanın görünümünü birebir korur.
- ✅ Zaten gerçek metni olan sayfaları atlar.
- ❌ PDF'i düzenlenebilir bir Word dosyasına dönüştürmez — bunun için PDF→Word aracını kullanın.
- ❌ El yazısını güvenilir biçimde okumaz.
İyi taramalar daha iyi sonuç verir
OCR hatalarının çoğu, OCR daha çalışmadan görüntü kalitesiyle belirlenir:
- 300 DPI'de tarayın. Yaklaşık 200 DPI'nin altında benzer harf şekillerini ayırt etmek zorlaşır.
- Sayfaları düz tutun. Eğrilik otomatik düzeltilir ama düz başlamak daha temiz sonuç verir.
- Gölgelerden kaçının. Telefon fotoğraflarındaki en yaygın sorun budur — sayfaya düşen gölge, mürekkeple kağıt arasındaki sınırı bulanıklaştırır.
- İmkân varsa fotoğraf yerine tarayıcı çıktısını tercih edin.
Görüntü ne kadar temizse OCR o kadar az hata yapar. Sonuç kötü geldiyse, OCR'ı yeniden çalıştırmaktansa daha yüksek çözünürlükte yeniden taramak neredeyse her zaman daha çok işe yarar.
OCR'dan sonra
Metin katmanı oluştuktan sonra belge, diğer metin PDF'leri gibi davranır. Sık yapılan sonraki adımlar:
- İçeriği paragraflar halinde düzenlemeniz gerekiyorsa Word'e dönüştürün.
- Tarama içinde çalışmanız gereken veri varsa tablolarını Excel'e aktarın.
- Sıkıştırın — taramalar büyüktür, metin katmanı da biraz daha ekler.
Maliyeti
OCR aracının kullanımı ücretsizdir; üyelik ve günlük sınır yoktur — istediğiniz kadar belge yükleyip sonucu görebilir, ondan sonra karar verebilirsiniz. Biten dosyayı indirmek için abonelik gerekir, istediğiniz an iptal edebilirsiniz.