AraçKutusu

PDF OCR (Taranmış PDF'ten Metin)

Taranmış veya fotoğraftan oluşan PDF'lerdeki yazı seçilemez. Bu araç sayfaları OCR ile okuyup düzenlenebilir metne çevirir. Türkçe desteklidir ve belgeniz cihazınızdan çıkmaz.

Taranmış PDF'i buraya bırakın

veya bilgisayarından seç

Fotoğraf/tarama içeren PDF'lerdeki yazıyı metne çevirir.

PDF OCR (Taranmış PDF'ten Metin) nedir, ne işe yarar?

PDF OCR, taranmış (yani aslında sayfaların fotoğrafından oluşan) PDF'lerdeki yazıyı okuyup kopyalanabilir metne çeviren işlemdir. Bu tür belgelerde metin seçilemez; ne kopyalayabilir ne de içinde arama yapabilirsiniz. OCR bu sorunu çözer.

Araç, PDF'in her sayfasını yüksek çözünürlükte görüntüye çevirir ve OCR ile okur. Tüm işlem tarayıcınızda yapılır, belgeniz sunucuya gitmez. Türkçe desteklidir; çıkan metni düzenleyip kopyalayabilir veya .txt olarak indirebilirsiniz.

PDF OCR (Taranmış PDF'ten Metin) nasıl yapılır?

  1. Taranmış (fotoğraf içeren) PDF'inizi yükleyin.
  2. Metnin dilini seçin (Türkçe, İngilizce veya ikisi).
  3. “Metni çıkar”a basın; her sayfa sırayla okunur.
  4. Çıkan metni kopyalayın veya .txt olarak indirin.

Nerelerde kullanılır?

  • Taranmış sözleşme veya dilekçedeki metni düzenlenebilir hâle getirmek
  • Eski, taranmış belgelerde metin araması yapabilmek için yazıyı çıkarmak
  • Fotokopisi çekilip taranan notları dijital metne dönüştürmek
  • Görüntü tabanlı PDF'lerden alıntı almak

İpuçları

  • Kaynak tarama ne kadar net ve yüksek çözünürlüklüyse sonuç o kadar doğru olur.
  • Zaten seçilebilen (metin tabanlı) PDF'lerde PDF → Word aracı daha hızlı ve kesindir.
  • Çok sayfalı belgelerde işlem uzayabilir; ilk çalıştırmada dil dosyası bir kez indirilir.

Taranmış PDF ile dijital PDF farkı

İki farklı PDF türü vardır ve hangi araca ihtiyaç duyduğunuzu bu belirler. Dijital PDF bilgisayarda üretilmiştir; içinde gerçek metin katmanı bulunur, yazıyı fareyle seçip kopyalayabilirsiniz. Taranmış PDF ise belgenin fotoğrafıdır; içinde harf yoktur, yalnızca piksel vardır.

Belgenizde yazıyı seçemiyorsanız o belge taranmıştır. Böyle bir dosyada arama yapmak, metin kopyalamak veya Word'e çevirmek mümkün değildir. Optik karakter tanıma tam olarak bu boşluğu doldurur: görüntüdeki harf şekillerini tanıyıp metne dönüştürür.

Tanıma başarısını ne belirler?

En belirleyici etken tarama kalitesidir. Düz, iyi aydınlatılmış, 300 DPI çözünürlükte taranmış bir sayfada tanıma neredeyse kusursuz çalışır. Telefonla eğik açıdan, gölgeli ortamda çekilmiş bir sayfada ise hata oranı hızla yükselir.

Yazı tipi de fark yaratır. Standart baskı yazı tipleri sorunsuz tanınır; el yazısı, süslü yazı tipleri ve çok küçük punto metinler zorlanır. Türkçe karakterler için dil desteğinin doğru seçilmesi şarttır, aksi hâlde ı, ş, ğ harfleri yanlış tanınır.

Sonucu her zaman kontrol edin

Optik tanıma bir tahmin işlemidir ve hata yapar. En sık karışan karakterler bellidir: sıfır ile büyük O, bir rakamı ile küçük l, rn ikilisi ile m harfi. Rakam içeren belgelerde bu hatalar ciddi sonuç doğurabilir.

Bu yüzden özellikle tutar, tarih ve kimlik numarası içeren belgelerde çıkan metni özgün görüntüyle karşılaştırmak gerekir. İşlem tarayıcınızda yapılır; belgeniz hiçbir sunucuya yüklenmez.

Sık sorulan sorular

Taranmış PDF ile normal PDF farkı nedir?

Normal PDF'lerde metin zaten seçilebilir. Taranmış PDF'ler ise aslında sayfaların fotoğrafıdır; içindeki yazı seçilemez. Bu araç OCR ile o fotoğraflardaki yazıyı okuyup metne çevirir.

Metni seçilebilen PDF'ten yazı almak için de kullanılır mı?

Metin zaten seçilebiliyorsa PDF → Word aracı daha hızlı ve doğrudur. PDF OCR özellikle taranmış, seçilemeyen belgeler içindir.

Dosyam sunucuya yükleniyor mu?

Hayır. PDF sayfaları tarayıcınızda görüntüye çevrilir ve OCR cihazınızda çalışır; belgeniz hiçbir sunucuya gönderilmez.

Çok sayfalı belgeler neden yavaş?

Her sayfa tek tek görüntüye çevrilip okunur; işlem cihazınızın gücüne bağlıdır. İlk çalıştırmada OCR motoru ve dil dosyası bir kez indirilir, sonrasında hızlanır.

İlgili araçlar