Taranmış PDF'ten metin nasıl çıkarılır?

Taranmış bir PDF, sayfa resimlerinden oluşan bir yığındır; seçilecek ya da kopyalanacak metin yoktur. Kelimeleri çıkarmak için OCR gerekir. Ücretsiz PDF'den metin aracı ikisini de tarayıcınızda yapar: dijital sayfaların metin katmanını doğrudan okur ve OCR'yi yalnızca resim olan sayfalara uygular.

PDF'teki metin neden kopyalanmıyor?

Genellikle sayfa bir tarama ya da PDF olarak kaydedilmiş bir fotoğraf olduğu için. Dosya harfleri gösterir ama altında yalnızca pikseller vardır. Bazı PDF'lerde yazar kopyalamayı da kapatmıştır. Tek bir kelimeyi işaretleyemiyorsanız metni kopyalamadan önce sayfanın OCR'den geçmesi gerekir.

PDF'in taranmış olduğu nasıl anlaşılır?

Dosyayı açın ve bir cümle seçmeyi deneyin. Kelimeler tek tek işaretleniyorsa sayfanın metin katmanı vardır. Sayfanın tamamı tek bir resim gibi seçiliyorsa ya da hiçbir şey seçilmiyorsa bu bir taramadır. Birçok PDF ikisini birden içerir: yazılmış sayfalar ve sonda birkaç taranmış ek.

PDF'e ücretsiz OCR nasıl yapılır?

  1. Aracı açınPDF'den metin sayfasına gidin.
  2. PDF'i ekleyin50 MB'a kadar bir dosya seçin.
  3. OCR dilini seçinTaranmış sayfaların doğru okunması için belgenin dilini seçin.
  4. ÇıkarınMetin katmanı olan sayfalar hemen çıkar; taranmış sayfalar tek tek tanınır.
  5. Kopyalayın ya da indirinSonucu kopyalayın ya da metin dosyası olarak kaydedin.

Çıkarılan metin nasıl temizlenir?

Taramalar cümleleri çoğu zaman her basılı satırın sonunda böler ve kelimeleri tireyle ayırır. Metinle kod üzerinden çalışıyorsanız birkaç satır JavaScript paragrafları yeniden birleştirir. OCR sonucunu text değişkenine yapıştırıp kodu tarayıcı konsolunda ya da Node.js'te çalıştırın.

join-ocr-lines.js
const text = `OCR sonucunu buraya yapıştırın`;

const cleaned = text
  .replace(/-\n(?=\p{Ll})/gu, '')   // tireyle bölünen kelimeleri birleştir
  .replace(/(?<!\n)\n(?!\n)/g, ' ') // tek satır sonları -> boşluk
  .replace(/[ \t]{2,}/g, ' ');      // tekrarlı boşluklar -> tek

console.log(cleaned);

Gizli belgelerde kullanmak güvenli mi?

Evet. PDF kendi tarayıcınızda işlenir ve hiçbir zaman sunucuya yüklenmez; bu yüzden sözleşmeler, faturalar ve sağlık belgeleri için uygundur. Daha iyi tarama daha iyi metin demektir: yeniden taramadan önce OCR doğruluğunu gerçekten neyin etkilediğini okuyun.

Elimde yalnızca sayfaların fotoğrafları varsa?

O zaman PDF adımını atlayıp doğrudan resim araçlarını kullanın: tek sayfa için resimdeki yazıyı kopyalama, aynı anda 20 sayfaya kadar çoklu resim OCR.

PDF'inizdeki metni çıkarın

Önce metin katmanı, taramalar için OCR. Hepsi tarayıcınızda.

İlgili yazılar

October 4, 2026
Rehber
Arbab Naseer

Resimden telefon numarası ve e-posta nasıl okunur?

Fotoğraf, broşür ya da ekran görüntüsündeki telefon numaralarını ve e-postaları tarayıcıda ücretsiz OCR ile çıkarın, tek rakam yazmadan kopyalayın.

October 4, 2026
Rehber
Arbab Naseer

iPhone, Android, Windows ve Mac'te resimdeki yazı nasıl kopyalanır?

iPhone, Android, Windows veya Mac'te resimdeki yazıyı kopyalayın: yerleşik araçlarla ya da her cihazda aynı çalışan ücretsiz tarayıcı OCR aracıyla.

October 3, 2026
Rehber
Arbab Naseer

Ekran görüntüsündeki yazı nasıl kopyalanır?

Ekran görüntüsünü düzenlenebilir metne çevirin: tarayıcıdaki ücretsiz OCR aracına yapıştırıp sonucu kopyalayın. Windows, Mac ve telefon kısayolları.

Bloga dön

We are also available in other languages

Ad Sponsored Check this offer
Ad Sponsored Check this offer