OCR Nedir? Anlamı, Nasıl Çalıştığı ve Bir PDF'e Ne Zaman Gerektiği

OCR, Optik Karakter Tanıma demektir — metin görüntülerini gerçek, aranabilir metne dönüştürür. Terimin anlamı, OCR taramanın ne olduğu ve PDF'inizin buna ihtiyacı olup olmadığı.

Güncellendi 1 Ağustos 20264 dk okuma

Tek cümleyle: OCR, Optik Karakter Tanıma demektir — bir görüntünün içindeki harfleri okuyup arayabileceğiniz, seçebileceğiniz ve kopyalayabileceğiniz gerçek metne dönüştürür.

Taranmış bir PDF açıp kelimeleri seçemediğinizi ya da Ctrl+F ile arayamadığınızı fark ettiyseniz, OCR'a ihtiyaç duyan bir belgeyle karşılaşmışsınız demektir.

OCR ne demek

Kısaltma İngilizce "Optical Character Recognition" ifadesinden gelir ve parçalara ayrıldığında anlamı netleşir:

  • Optik — tıpkı bir göz gibi, görüntü üzerinden çalışır.
  • Karakter — tek tek harfleri, rakamları ve noktalama işaretlerini ayırt eder.
  • Tanıma — her şeklin hangi karakter olma ihtimalinin en yüksek olduğuna karar verir.

Yani OCR, bir yazının fotoğrafına bakıp ne yazdığını çözme işidir. Girdisi piksel, çıktısı metindir.

PDF'te OCR ise şu anlama gelir: bir PDF ya gerçek karakterler barındırır ya da yalnızca sayfanın görüntüsünü. OCR ikinci türü alır ve görüntünün tam üstüne oturan görünmez bir gerçek metin katmanı ekler. Görsel olarak hiçbir şey değişmez — ama belge fotoğraf olmaktan çıkıp belge olmaya başlar.

OCR tarama nedir

İnsanlar çoğu zaman "OCR tarama" derken kağıttan aranabilir dosyaya giden yolun tamamını kastediyor. Aslında bu, birbirine karışan iki ayrı adımdır:

  1. Tarama — tarayıcı veya telefon kamerası sayfanın görüntüsünü üretir. Bu noktada bilgisayarın elinde yalnızca renkli noktalar vardır; dosyanın içinde "kelime" yoktur.
  2. OCR — yazılım bu görüntüyü çözümleyip içindeki karakterlerin ne olduğunu belirler.

Tarayıcı tek başına size aranabilir metin vermez. Bu terimle ilgili en yaygın yanlış anlaşılma tam olarak budur: tarayıcınız içinde arama yapamadığınız bir PDF ürettiyse, birinci adımı yapmış, ikinciyi atlamıştır.

OCR nasıl çalışır

Günümüzde OCR kabaca şu sırayla ilerler:

  1. Ön işleme — görüntü düzeltilir, harflerin arka plandan ayrılması için kontrast temizlenir.
  2. Düzen analizi — hangi bölgelerin metin, hangilerinin fotoğraf, tablo veya boşluk olduğu bulunur. Okuma sırası da burada çıkarılır: sütunlar, başlıklar, resim altı yazıları.
  3. Karakter tanıma — her şekil, seçilen dilde harflerin nasıl göründüğüne dair bir modelle eşleştirilir.
  4. Dil düzeltmesi — sözlük ve istatistiksel model, olası olmayan sonuçları düzeltir. "rn" ikilisinin genellikle "m" diye okunmamasının ve doğru dili seçmenin bu kadar önemli olmasının sebebi budur.
  5. Çıktı — tanınan metin, özgün görüntüyle hizalanmış görünmez bir katman olarak geri yazılır.

OCR ne zaman gerekir?

PDF görüntü tabanlıysa ve şunları istiyorsanız OCR gerekir:

  • belgeyi Ctrl+F ile aramak,
  • içinden metin kopyalamak,
  • başka araçlara (çeviri, indeksleme, veri çıkarımı) beslemek,
  • veya erişilebilirlik gereksinimlerini karşılamak — ekran okuyucular gerçek metne ihtiyaç duyar, metnin görüntüsü onlar için görünmezdir.

Word'den, tarayıcıdan veya herhangi bir uygulamadan dışa aktarılmış PDF'ler için OCR'a gerek yoktur. Bunlar zaten gerçek karakter içerir, üzerlerinde OCR çalıştırmak bir şey katmaz.

Bir PDF'in OCR'a ihtiyacı olup olmadığı nasıl anlaşılır

En hızlı test iki saniye sürer: dosyayı açın ve bir metin satırını seçmeyi deneyin.

Ne oluyorNe anlama geliyor
Tek tek kelimeler vurgulanıyorZaten gerçek metin — OCR gerekmez
Tüm sayfa tek blok halinde seçiliyor ya da hiçbir şey seçilmiyorGörüntüdür — OCR gerekir
Ctrl+F sayfada açıkça duran bir kelimeyi bulamıyorGörüntüdür — OCR gerekir

İkinci ipucu dosya boyutudur. On sayfalık bir metin PDF'i çoğunlukla 200 KB'ın altındadır; on taranmış sayfa ise genellikle birkaç megabayttır, çünkü her sayfa bir fotoğraftır.

OCR doğruluğunu ne belirler

Doğruluk büyük ölçüde OCR daha çalışmadan, görüntünün kalitesiyle belirlenir:

  • Çözünürlük. 300 DPI pratikte en verimli noktadır. ~200 DPI'nin altında harfler, benzer şekilleri birbirinden ayırmak için gereken ayrıntıyı kaybeder.
  • Düzgünlük. Eğri taranmış sayfalar sonucu ölçülebilir biçimde bozar. Çoğu yazılım eğriliği otomatik düzeltir ama düzgün başlamak daha iyidir.
  • Kontrast ve aydınlatma. Telefon fotoğrafındaki gölgeler ya da gri bir sayfanın gri taraması, mürekkeple kağıt arasındaki sınırı bulanıklaştırır.
  • Dil seçimi. Doğru dili seçmek doğru karakter kümesini ve sözlüğü devreye sokar. Bu, ç, ş, ü, ğ, ı gibi Türkçeye özgü karakterlerde çok büyük fark yaratır — yanlış dil modeliyle bunlar sıkça yanlış okunur.
  • Yazı tipi ve durum. Temiz basılmış metin neredeyse kusursuz okunur. El yazısı, süslü yazı tipleri, solmuş termal fişler ve üzeri damgalanmış metinler ise çok daha zordur.

OCR'ın yapmadıkları

Beklentiyi baştan netleştirmekte fayda var, çünkü bunlar sık yaşanan sürprizler:

  • PDF'i düzenlenebilir yapmaz. OCR metni aranabilir hale getirir; belgeyi düzenlenebilir paragraflara yeniden inşa etmez. Bunun için ayrı bir adım olarak PDF'i Word'e dönüştürmeniz gerekir.
  • El yazısını güvenilir biçimde okumaz. El yazısı tanıma farklı bir problemdir (bazen ICR, Akıllı Karakter Tanıma diye anılır) ve sonuçlar çok değişkendir.
  • Görüntüyü iyileştirmez. Sayfa neyse o kalır. OCR resmin üzerinde değil, arkasında çalışır.
  • Kusursuz değildir. Temiz bir taramada hata nadirdir ama sıfır değildir. Hukuki ya da mali açıdan önemli belgelerde sonucu gözden geçirin.

Bir PDF'i aranabilir yapmak

Bir belgenin tarama olduğunu anladıktan sonra OCR çalıştırmak saniyeler sürer. Adım adım taranmış PDF'i aranabilir yapma rehberine bakın veya doğrudan OCR aracına gidin — kullanımı ücretsiz, üyelik gerekmiyor.

Sıkça sorulan sorular

OCR ne demek?+

OCR, İngilizce "Optical Character Recognition" ifadesinin kısaltmasıdır; Türkçesi Optik Karakter Tanıma'dır. Bir görüntünün içindeki harfleri okuyup gerçek, makine tarafından işlenebilir metne dönüştürme işlemidir.

PDF'te OCR ne anlama gelir?+

PDF'te OCR, taranmış sayfa görüntülerinin üzerine görünmez bir metin katmanı eklemek demektir. Sayfa aynı görünmeye devam eder ama altındaki kelimeler artık aranabilir, seçilebilir ve kopyalanabilir olur.

OCR tarama nedir?+

OCR tarama iki adımın birleşimidir: önce kağıt belgenin görüntüye taranması, ardından bu görüntü üzerinde OCR çalıştırılması. Böylece ortaya çıkan dosya, metnin resmini değil gerçek metni içerir.

Taranmış PDF ile metin PDF'i aynı mıdır?+

Hayır. Taranmış PDF sayfanın bir görüntüsüdür; metin seçilemez. Metin (dijital) PDF ise arayıp kopyalayabileceğiniz gerçek karakterleri saklar. OCR birincisini ikincisine dönüştürür.

OCR fotoğraflarda çalışır mı?+

Evet. Metin yeterince net ve iyi aydınlatılmış olduğu sürece OCR, belge fotoğrafları dahil her türlü metin görüntüsünde çalışır.

OCR %100 doğru mudur?+

Hiçbir OCR kusursuz değildir ama temiz taramalarda doğruluk çok yüksektir. Doğru dili seçmek ve 300 DPI'de taramak hataları büyük ölçüde azaltır.

OCR bir PDF'i Word'de düzenlenebilir hale getirir mi?+

Tek başına hayır. OCR metni PDF içinde aranabilir ve kopyalanabilir yapar. Düzenlenebilir bir belge için ayrıca PDF'i Word'e dönüştürmeniz gerekir; bu ayrı bir adımdır.

İlgili araçlar

Hemen dene