AraçKutusu

Görselden Metin (OCR)

Görseli yükleyin; içindeki yazı OCR ile çıkarılıp kopyalanabilir metne dönüşsün. Türkçe desteklenir, tümü tarayıcınızda çalışır.

Yazı içeren görseli bırakın

veya bilgisayarından seç

Ekran görüntüsü, fotoğraf veya taranmış belge — JPG, PNG, WebP.

Görselden Metin (OCR) nedir, ne işe yarar?

Görselden metin çıkarma (OCR), bir fotoğraf, ekran görüntüsü veya taranmış belgedeki yazıyı bilgisayarın okuyabileceği, kopyalanabilir metne dönüştürme işlemidir. Bir kitabın sayfasını, tabelayı ya da ekrandaki bir yazıyı elle yeniden yazmak yerine saniyeler içinde metne çevirebilirsiniz.

Bu araçta OCR motoru ve dil dosyaları tarayıcınıza inip işlemi tamamen cihazınızda yapar; görseliniz hiçbir sunucuya yüklenmez. Türkçe karakterler dâhil metni çıkarır, düzenlemenize ve kopyalamanıza olanak tanır.

Görselden Metin (OCR) nasıl yapılır?

  1. İçinde yazı olan görseli (fotoğraf, ekran görüntüsü, tarama) yükleyin.
  2. Metnin dilini seçin (Türkçe, İngilizce ya da ikisi).
  3. “Metni çıkar”a basın; ilerleme çubuğunu izleyin.
  4. Çıkan metni düzenleyip “Metni kopyala” ile kullanın.

Nerelerde kullanılır?

  • Kitap veya dergi sayfasındaki metni yazıya dökmek
  • Ekran görüntüsündeki yazıyı kopyalanabilir hâle getirmek
  • Kartvizit veya tabeladaki bilgileri metne çevirmek
  • Taranmış belgedeki yazıyı düzenlenebilir metne almak

İpuçları

  • En doğru sonuç için net, iyi ışıklı ve düz çekilmiş görseller kullanın.
  • Metin dilini doğru seçin; Türkçe belgelerde Türkçe modeli ç, ğ, ş, ı gibi karakterleri tanır.
  • Taranmış çok sayfalı PDF'ler için PDF OCR aracını kullanın.

Görüntüdeki yazı nasıl metne dönüşür?

Optik karakter tanıma, görüntüdeki harf şekillerini tanıyıp karşılık gelen karakterlere çevirir. İşlem birkaç aşamalıdır: önce sayfa düzeltilir ve metin bölgeleri bulunur, sonra satırlar ve kelimeler ayrıştırılır, en sonunda her karakter tanınır.

Bu bir tahmin sürecidir; kesinlik yüzde yüz değildir. Tanıma modeli her karakter için en olası adayı seçer ve komşu harflerden gelen bağlamı kullanır. Bu yüzden anlamlı kelimeler, rastgele karakter dizilerinden daha doğru tanınır.

Tanıma kalitesini artırmak

En büyük etken görüntü kalitesidir. Sayfanın düz durması, iyi ve eşit aydınlatılmış olması, gölge içermemesi ve yeterli çözünürlükte olması sonucu doğrudan belirler. Eğik çekilmiş bir sayfada satırlar birbirine karışır.

Türkçe metinlerde dil desteğinin doğru seçilmesi şarttır. İngilizce modeliyle taranan Türkçe bir metinde ı, ş, ğ, ç harfleri sürekli yanlış tanınır ve sonuç kullanılamaz hâle gelir.

Sonucu kontrol etmek gerekir

En sık karışan karakterler bellidir: sıfır ile büyük O, bir rakamı ile küçük l, rn ikilisi ile m. Rakam içeren belgelerde bu hatalar ciddi sonuç doğurur.

Tutar, tarih ve kimlik numarası içeren belgelerde çıkan metni özgün görüntüyle karşılaştırmak zorunludur. İşlem tarayıcınızda yapılır; görseliniz hiçbir sunucuya yüklenmez.

Sık sorulan sorular

OCR nedir?

OCR (Optical Character Recognition / Optik Karakter Tanıma), bir görseldeki yazıyı bilgisayarın okuyabileceği, kopyalanabilir metne çeviren teknolojidir. Fotoğraftaki veya taranmış belgedeki yazıyı elle yeniden yazmaktan kurtarır.

Türkçe karakterleri (ç, ğ, ş, ı) tanıyor mu?

Evet. Türkçe dil modeli kullanıldığında ç, ğ, ı, ö, ş, ü karakterleri de tanınır. En iyi sonuç için görselin net ve yazının okunaklı olmasına dikkat edin.

Görselim sunucuya yükleniyor mu?

Hayır. OCR motoru ve dil dosyaları tarayıcınıza inip işlemi cihazınızda yapar; görseliniz hiçbir sunucuya gönderilmez. Bu yüzden gizli belgeler için de güvenlidir.

İlk kullanımda neden biraz bekliyor?

İlk çalıştırmada OCR motoru ve seçtiğiniz dil dosyası bir defaya mahsus indirilip cihazınıza kaydedilir. Sonraki kullanımlarda bu adım atlanır ve işlem hızlanır.

Hangi görseller en iyi sonucu verir?

Düz, iyi ışıklı ve yüksek çözünürlüklü görseller en doğru sonucu verir. Eğik, bulanık veya çok küçük yazılarda doğruluk düşebilir.

İlgili araçlar