OCR Nedir? Optik Karakter Tanıma ve Belge Otomasyonu
OCR (Optical Character Recognition — optik karakter tanıma), görüntüdeki yazıyı makinenin okuyabildiği metne çevirme teknolojisidir: taranmış fatura, fotoğraflanmış irsaliye, PDF içindeki tablo... İnsan gözünün okuduğunu sistemin de okuması, belge yoğun süreçlerin otomasyon kapısıdır.
Klasik OCR'dan Akıllı Belge İşlemeye
Klasik OCR harfleri tanır ama anlamaz: çıktısı düz metindir. Yapay zeka destekli belge işleme ise bir adım öteye geçer — belgenin türünü sınıflar, alanları anlamlandırır: "bu bir fatura, tutar şu, tarih bu, tedarikçi şu." Farklı formatlardaki belgelerden yapılandırılmış veri çıkarabilmesi, onu şablon bağımlısı eski nesilden ayırır.
Kurumsal Süreçlerde Kullanım
- Gelen fatura işleme: kağıt/PDF faturaların verilerinin kayda hazırlanması (e-fatura kapsamı dışında kalanlar için)
- İrsaliye ve mal kabul: sürücünün getirdiği evrakın depoda anında sisteme okunması
- Sözleşme ve evrak arşivi: taranan belgelerin içeriğiyle aranabilir hale gelmesi
- Destek süreçleri: kullanıcının gönderdiği ekran görüntüsündeki hatanın okunup anlamlandırılması
- Ana veri hazırlığı: eski sistem çıktılarından, listelerden ve kataloglardan veri çıkarma
Doğru Beklenti
OCR'ın çıktısı olasılıklıdır — %100 değil. Sağlıklı kurgu, güven eşiğiyle çalışır: yüksek güvenli alanlar otomatik akar, düşük güvenliler insana sorulur. Ve öncelik sırası unutulmamalıdır: belge zaten elektronik doğabiliyorsa (e-fatura, e-irsaliye, EDI) OCR'a hiç iş bırakmamak, en iyi OCR stratejisidir.