Taranmış Belgeyi Düzenlenebilir Metne Çevirme (OCR Rehberi)
Elinizde taranmış bir belge var. İçindeki bir cümleyi kopyalamak istiyorsunuz ama fare ile seçemiyorsunuz. Ctrl+F ile arama yapıyorsunuz, hiçbir şey bulunamıyor. Neden?
Çünkü o belge, bilgisayar açısından bir metin değil, bir fotoğraftır. Siz harfleri görüyorsunuz ama bilgisayar yalnızca siyah-beyaz noktalar görüyor.
OCR nedir?
OCR (Optical Character Recognition — Optik Karakter Tanıma), bir görüntüdeki harf şekillerini tanıyıp gerçek metne çeviren teknolojidir. Bir insanın el yazısını okuması gibi: şekle bakar, hangi harf olduğuna karar verir.
Bu bir tahmin işlemidir; dolayısıyla %100 doğruluk garantisi yoktur. Net bir bilgisayar çıktısında doğruluk %99'un üzerine çıkabilir; soluk bir fotokopide %80'e düşebilir.
Belgenizin taranmış olup olmadığını anlayın
PDF'i açın ve bir kelimeye çift tıklayın. Kelime maviye dönüp seçiliyorsa gerçek metindir — OCR'a ihtiyacınız yok, doğrudan PDF to Word veya PDF'ten Metin Çıkar aracını kullanın; sonuç birebir doğru olur.
Seçemiyorsanız belge taranmıştır ve OCR gerekir.
OCR nasıl yapılır?
- Taranmış Belge → Word (OCR) — çok sayfalı taranmış PDF'leri düzenlenebilir Word belgesine çevirir.
- Görselden Metin Çıkar — tek bir fotoğraftaki yazıyı metne çevirir.
Her iki araç da tarayıcınızda çalışır. İlk kullanımda Türkçe dil modelini indirmesi gerekir (birkaç megabayt); sonraki kullanımlarda önbellekten gelir. Belgeniz hiçbir yere gönderilmez — indirilen şey yalnızca dil modelidir.
Doğruluğu artırmanın yolları
1. Çözünürlük: 300 DPI hedefleyin
OCR için en önemli etken çözünürlüktür. 150 DPI'da taranmış bir belgede harfler yeterince belirgin olmaz ve tanıma oranı düşer. 300 DPI ideal noktadır; 600 DPI ise dosyayı gereksiz büyütür ve belirgin bir fayda sağlamaz.
2. Belgeyi düz tarayın
Eğik taranmış sayfalarda satırlar eğimli olur ve tanıma oranı ciddi biçimde düşer. Telefon kamerası kullanıyorsanız, belgeyi tam tepeden ve düz çekin — ya da telefonunuzun tarama uygulamasını kullanın; bu uygulamalar kenarları algılayıp perspektifi otomatik düzeltir.
3. Kontrast ve aydınlatma
Gölgeli veya soluk fotokopiler OCR'ın en büyük düşmanıdır. Araçlarımız görüntüyü otomatik olarak gri tonlamaya çevirip kontrastı artırır, ama kaynak ne kadar temizse sonuç o kadar iyi olur.
4. Doğru dili seçin
Türkçe belgelerde Türkçe modeli kullanmak şarttır. İngilizce model, "ş" ve "ğ" harflerini tanımadığı için bunları "s" ve "g" olarak okur. Karma belgelerde (Türkçe + İngilizce) her iki dili birden seçmek daha iyi sonuç verir.
OCR'ın zorlandığı durumlar
- El yazısı: Standart OCR el yazısını okuyamaz. Bu tamamen farklı bir teknoloji (HTR) gerektirir.
- Süslü yazı tipleri: Dekoratif fontlar, gotik yazı ve çok ince fontlar tanıma oranını düşürür.
- Karmaşık tablolar: Metin okunur ama tablo yapısı genellikle korunmaz; hücreler alt alta düz satırlar hâline gelebilir.
- Filigranlı belgeler: Metnin üzerinden geçen filigran, harfleri bozarak tanımayı zorlaştırır.
- Çok sütunlu düzen: Gazete veya dergi sayfalarında sütunlar karışabilir.
Sonucu mutlaka kontrol edin
OCR çıktısını gözden geçirmeden kullanmayın. Özellikle şu karakterler sık karıştırılır:
- büyük I / küçük l / rakam 1
- rakam 0 / büyük O
- rakam 5 / harf S
- rakam 8 / harf B
Sayı içeren belgelerde (fatura, bilanço, tutanak) bu hatalar ciddi sonuçlar doğurabilir. Tutarları ve tarihleri mutlaka özgün belgeyle karşılaştırın.
Özet
OCR, taranmış belgeleri yeniden yazma zahmetinden kurtarır ama bir tahmin teknolojisidir. İyi bir tarama (300 DPI, düz, iyi aydınlatılmış) doğruluğu belirgin biçimde artırır; çıktıyı gözden geçirmek ise her koşulda gereklidir.