PDF İçinde Kelime Arama: Uzun Belgede Aradığını Saniyede Bulmak
Elinizde 180 sayfalık bir kira sözleşmesi var ve "cayma" kelimesinin geçtiği maddeyi bulmanız gerekiyor. Ya da muhasebeye gönderilecek bir fatura yığınında belirli bir vergi numarasını arıyorsunuz. Belki de vize dosyanızda "ikametgâh" ifadesinin hangi sayfada geçtiğini bilmeniz lazım. Sayfa sayfa gözle taramak hem zaman kaybı hem de hata kaynağı: göz yorulur, kelime atlanır.
PDF7'nin PDF içinde metin bul aracı tam olarak bu iş için var. Dosyayı yükleyin, aradığınız kelimeyi yazın, hangi sayfalarda kaç kez geçtiğini ve sayfanın neresinde durduğunu görün.
PDF içinde kelime arama nasıl yapılır
- Dosyayı yükleyin. PDF, Word (DOCX), Excel (XLSX) veya JPG/PNG bir resim seçin. Sürükleyip bırakabilirsiniz.
- Aradığınız kelimeyi yazın. İsterseniz "tam kelime" ve "büyük/küçük harfe duyarlı" seçeneklerini açın.
- Sonuçları inceleyin. Liste görünümünde her eşleşme sayfa numarasıyla ve çevresindeki cümleyle birlikte gelir. Görsel modda ise sayfalar küçük resim ızgarası olarak dizilir, bulunan kelimelerin üzeri sarı kutuyla işaretlenir; bir sayfaya tıklayıp büyütebilirsiniz.
Türkçe PDF'lerde arama neden çoğu araçta çuvallar?
Türkçe'nin kendine has bir harf tuzağı vardır: i / İ ve ı / I. Çoğu arama motoru İngilizce kuralına göre çalışır ve "i" harfinin büyük hâlini "I" sanar. Sonuç: belgede İMZA yazıyorsa, siz imza diye arattığınızda hiçbir sonuç çıkmaz. Aynı şekilde ILICA ile ılıca birbirini bulamaz.
PDF7'nin arama motoru Türkçe harf katlamasını doğru yapar: imza araması İmza, IMZA ve ımza yazımlarını da yakalar. Aynı mantık ç/Ç, ş/Ş, ğ/Ğ, ö/Ö, ü/Ü için de geçerlidir. Buna karşılık tam kelime seçeneğini işaretlerseniz, imza araması imzalayan veya imzasız kelimelerini saymaz — yalnız tek başına geçen "imza" bulunur. Sözleşmede kaç yerde "imza" maddesi olduğunu sayarken bu fark önemlidir.
Bir başka pratik ayrıntı: bazı PDF üreticileri Türkçe karakterleri farklı kodlarla gömer. Arama motoru metni okurken bu farkları normalize eder, böylece "ş" harfi belgede nasıl kodlanmış olursa olsun eşleşir.
Sonuç çıkmadıysa denenecek beş şey
Kelimenin belgede olduğundan eminsiniz ama arama boş dönüyorsa, sırayla şunları deneyin:
- Kısaltın. "faturalandırma" yerine "fatura" arayın. Türkçe eklemeli bir dildir; aradığınız kelime metinde büyük olasılıkla ek almış hâlde geçer.
- Tam kelime seçeneğini kapatın. Açık kaldığında yalnız kelimenin tek başına geçtiği yerler sayılır.
- Sayfada metin seçilebiliyor mu bakın. Seçilemiyorsa belge taranmıştır; o zaman OCR gerekir.
- Görsel moda geçin. Sayfa görüntüsünde kelimenin gerçekte hangi yazımla geçtiğini gözünüzle görürsünüz — çoğu zaman belgede kısaltma veya eş anlamlı bir terim kullanılmıştır.
- Boşluk ve noktalamayı çıkarın. "T.C. Kimlik No" gibi ifadelerde noktalar farklı yazılmış olabilir; sadece "Kimlik" aramak daha güvenlidir.
Bu araç aynı zamanda bir sayaç gibi de kullanılır: bir raporda "gecikme" kelimesinin kaç kez geçtiğini, bir tezde bir kaynağa kaç kez atıf yapıldığını doğrudan sonuç listesinden görebilirsiniz.
Taranmış PDF ve fotoğraflarda arama
Fotokopi makinesinden çıkmış ya da telefonla fotoğraflanmış bir belge aslında bir resimdir; içinde seçilebilir metin yoktur. Normal arama böyle bir dosyada hiçbir şey bulamaz.
Araç bu durumu algılar ve sayfayı kademeli olarak OCR'dan geçirir: önce hızlı bir tarama yapar, sonuç bulunamazsa daha ayrıntılı bir okuma dener. Böylece taranmış tapu senedinde, elden alınmış bir dekontta veya ders notu fotoğrafında da arama yapabilirsiniz. Belgenin tamamını kalıcı olarak aranabilir hâle getirmek isterseniz PDF OCR aracıyla önce metin katmanı ekleyip sonra arama yapmak daha hızlı olur.
Şifreli PDF'te arama
Bankadan gelen ekstreler ve e-devlet çıktıları çoğu zaman parolayla korunur. Böyle bir dosyayı yüklediğinizde araç sizi başka sayfaya atmaz; dosya kartının üzerinde küçük bir parola kutusu açılır. Parolayı yazarsınız, belge açılır ve arama normal şekilde çalışır. Parola hiçbir yere kaydedilmez.
Dosyalarınıza ne oluyor?
Yüklediğiniz dosya yalnızca arama işlemi için işlenir; sunucuda saklanmaz ve dışarıdaki hiçbir servise gönderilmez. Arama tamamen PDF7 üzerinde yapılır, üçüncü taraf bir API kullanılmaz. Sözleşme, sağlık raporu veya bordro gibi hassas belgelerde bu fark önemlidir.
Birden fazla belgede aynı kelimeyi arayacaksanız, önce PDF birleştirme aracıyla dosyaları tek PDF hâline getirmek işinizi kolaylaştırır. Dosya çok büyükse PDF sıkıştırma ile boyutu düşürebilirsiniz.
Sıkça sorulan sorular
Türkçe karakterli kelime aratabiliyor muyum?
Evet. ç, ş, ğ, ü, ö, ı ve İ dâhil tüm Türkçe harfler desteklenir. Büyük/küçük harf eşleştirmesi Türkçe kurallarına göre yapılır, İngilizce kuralına göre değil.
Sadece PDF mi destekleniyor?
Hayır. PDF dışında Word belgeleri (paragraflar ve tablo hücreleri dâhil), Excel dosyaları ve JPG/PNG resimler de aranabilir.
Kaç sayfalık belgede arama yapabilirim?
Uzun belgeler desteklenir. Metin katmanı olan PDF'lerde arama neredeyse anında biter; taranmış sayfalarda OCR gerektiği için süre sayfa sayısına göre uzar.
Bulunan kelimenin yerini görebiliyor muyum?
Evet. Görsel modda sayfa görüntüsü üzerinde eşleşmelerin etrafına sarı kutu çizilir; sonuçlar arasında ileri geri gezinebilirsiniz.
Aracı denemek için PDF içinde metin bul sayfasına gidin — kayıt gerekmez, ücretsizdir.