PDF Metadata Düzenleme ve Temizleme Nasıl Yapılır?
6 dk okuma
Bir PDF'i başkasına gönderdiğinizde sadece gördüğünüz sayfaları göndermiyorsunuz. Dosyanın içinde, sayfalarda görünmeyen bir bilgi katmanı var: kimin oluşturduğu, hangi programla üretildiği, ne zaman değiştirildiği, hangi anahtar kelimelerle etiketlendiği. Bu bilgiler bazen faydalı, bazen tamamen gereksiz, bazen de paylaşmak istemediğiniz türden.
PDF'te ne saklanıyor
Metadata, belge hakkındaki bilgidir — belgenin içeriği değil. Tipik bir PDF'te şunlar bulunur:
| Alan | Tipik içerik | Nereden gelir | |---|---|---| | Başlık (Title) | Belgenin adı | Genellikle boş veya dosya adı | | Yazar (Author) | Kişi veya kurum adı | Word/işletim sistemi kullanıcı adı | | Konu (Subject) | Kısa açıklama | Genellikle boş | | Anahtar kelimeler | Etiketler | Genellikle boş | | Üretici (Producer) | PDF'i üreten kütüphane | Otomatik | | Oluşturan (Creator) | Kaynak uygulama | Otomatik ("Microsoft Word") | | Oluşturma tarihi | İlk üretim zamanı | Otomatik | | Değiştirme tarihi | Son kaydetme zamanı | Otomatik |
Bunlardan çoğu otomatik doldurulur ve fark etmezsiniz. Yazar alanı en sık sorun çıkaranıdır: Word, belgeyi oluştururken işletim sistemi kullanıcı adınızı buraya yazar. Bu, tam adınız, kurumsal kullanıcı adınız veya bilgisayarınızı kuran kişinin adı olabilir.
Metadata neyi ele verir
Somut örneklerle:
Anonim gönderilen bir belgede yazar adı. Bir ihbar, değerlendirme veya anonim geri bildirim belgesi gönderiyorsanız yazar alanı kimliğinizi doğrudan açık edebilir.
Şablon kullanımı. Bir teklifi başka bir müşteriye hazırladığınız tekliften kopyaladıysanız, başlık alanında hâlâ önceki müşterinin adı yazıyor olabilir.
Zaman çizelgesi. Oluşturma ve değiştirme tarihleri, belgenin ne zaman hazırlandığını gösterir. "Bu raporu üç haftadır hazırlıyoruz" derken oluşturma tarihi dün ise durum tuhaflaşır.
Kullanılan yazılım. Üretici alanı hangi programı ve sürümünü kullandığınızı gösterir. Güvenlik açısından bu bilgi, hedefli saldırılarda kullanılabilir.
Kurumsal iz. Bazı kurumsal PDF üreticileri özel alanlar ekler: departman kodu, belge sınıflandırması, dahili referans numarası.
Adım 1: Mevcut metadata'yı görün
Değiştirmeden önce ne olduğunu bilmek gerekiyor.
PDF görüntüleyicide: Çoğu görüntüleyicide Dosya > Özellikler (veya Belge Özellikleri) menüsünden temel alanları görebilirsiniz.
Windows'ta: Dosyaya sağ tıklayıp Özellikler > Ayrıntılar sekmesine bakın. Ancak burada gösterilen alanlar sınırlıdır.
Aracın kendisinde: Metadata düzenleme aracını açıp dosyanızı yüklediğinizde mevcut değerler karşınıza gelir. Bu, en kapsamlı görünümü verir.
Bakarken şu üç soruyu sorun: Bu alanlarda kişisel bilgi var mı? Yanlış veya eski bilgi var mı? Boş bırakılması gereken bir şey dolu mu?
Adım 2: Ne yapacağınıza karar verin — düzenlemek mi, silmek mi?
İki farklı ihtiyaç var ve karıştırılmamalı.
Düzenleme, alanları doğru bilgiyle doldurmaktır. Web'de yayınlayacağınız bir belgede anlamlıdır:
- Başlık, tarayıcı sekmesinde ve bazı arama sonuçlarında görünür. Dosya adı yerine gerçek bir başlık koymak profesyonel durur.
- Yazar, kurum adı olarak ayarlanabilir — kişi adı yerine "Örnek Belediyesi" gibi.
- Konu, kısa bir açıklama olarak faydalıdır.
Silme ise gizlilik amaçlıdır. Belgeyi dışarıya gönderiyorsanız ve hiçbir iz kalmasını istemiyorsanız tüm alanları boşaltırsınız.
İkisini karıştırmayın: web'de yayınlanan bir belge için metadata doldurmak doğru, dışarıya gönderilen hassas bir belge için silmek doğrudur.
Adım 3: Değişikliği uygulayın
Aracı açın, dosyanızı yükleyin ve alanları düzenleyin ya da temizleyin. İşlem tarayıcınızda yapılır — metadata temizliği genellikle gizlilik amaçlı yapıldığı için dosyanın sunucuya gitmemesi konunun tam da özüdür.
Dikkat edilecek teknik bir nokta: PDF'ler metadata'yı iki farklı yerde saklayabilir.
Belge Bilgisi (Document Info) sözlüğü, formatın eski ve basit yapısıdır. Başlık, yazar, konu gibi birkaç anahtar içerir.
XMP (Extensible Metadata Platform), XML tabanlı çok daha zengin bir standarttır ve dosyaya gömülü bir metin bloğu olarak durur. Aynı bilgileri, artı çok daha fazlasını taşıyabilir.
Birçok PDF her ikisini birden içerir ve değerler çelişebilir: Belge Bilgisi'nde silinmiş bir yazar adı, XMP bloğunda hâlâ duruyor olabilir. Güvenilir bir temizlik ikisini de ele almalıdır. Temizlik sonrası dosyayı bir metin editöründe açıp (kaydetmeden) <xmp veya dc:creator gibi ifadeleri aratmak, işin gerçekten yapıldığını doğrulamanın kaba ama etkili bir yoludur.
Adım 4: Sonucu doğrulayın
İndirilen dosyayı açın ve Belge Özellikleri'ne bakın. Alanlar beklediğiniz gibi mi?
Ek olarak şunları kontrol edin:
Tarihler. Metadata temizleme, değiştirme tarihini genellikle güncel zamana ayarlar — çünkü dosya az önce yeniden yazılmıştır. Oluşturma tarihini de temizlemek istiyorsanız bunun ayrı bir alan olduğunu unutmayın.
Üretici alanı. Temizleme sonrası bu alanda kullandığınız aracın adı yazabilir. Tam anonimlik istiyorsanız bunu da boşaltın.
Özel alanlar. Kurumsal PDF'lerde standart dışı özel anahtarlar bulunabilir. Aracınız bunları gösteriyorsa kontrol edin.
Metadata temizlemenin sınırı
Bu, en önemli bölüm ve yaygın bir yanlış anlamayı düzeltiyor.
Metadata temizlemek, sayfadaki bilgiyi silmez. Belgenin 3. sayfasında adınız yazıyorsa, metadata'yı ne kadar temizlerseniz temizleyin o isim orada durur.
Metadata temizlemek, gizli sayfa içeriğini kaldırmaz. Bir bilgiyi siyah kutuyla örtmüşseniz, alttaki metin dosyada durur. Bu, redaksiyon aracının işidir.
Metadata temizlemek, gömülü dosyaları kaldırmaz. Bazı PDF'ler ek dosyalar (Excel tabloları, kaynak dosyalar) gömülü olarak taşır.
Metadata temizlemek, sürüm geçmişini kaldırmayabilir. Artımlı güncelleme geçmişi olan bir PDF'te önceki sürümler dosyada durabilir. Dosyayı tam yeniden yazan bir işlemden (sıkıştırma gibi) geçirmek bunu genellikle temizler.
Gerçekten hassas bir belgeyi dışarı gönderiyorsanız kontrol listeniz şöyle olmalı:
- Sayfa içeriğinde gizlenecek bilgi var mı? → Redaksiyon
- Metadata'da iz var mı? → Metadata temizleme
- Gömülü dosya var mı? → Kontrol edin
- Sürüm geçmişi var mı? → Sıkıştırma veya yeniden üretim
- Form alanlarında veri kaldı mı? → Düzleştirme
Web'de yayınlanan PDF'ler için
Metadata'yı silmek yerine doldurmak istediğiniz durum budur:
Başlık alanını mutlaka doldurun. Boş bırakılırsa tarayıcı sekmesinde dosya adı görünür ("rapor_final_v3.pdf" gibi). Gerçek bir başlık koymak hem profesyonel durur hem de arama sonuçlarında daha iyi görünür.
Yazarı kurum adı yapın. Kişisel adınız yerine kurumunuzun adını koymak hem gizlilik hem tutarlılık sağlar.
Konu alanını kısa bir açıklama olarak kullanın.
Anahtar kelimelere fazla yatırım yapmayın. Bu alanın arama motorları üzerindeki etkisi uzun süredir yok denecek kadar azdır. Belgeyi bulunur kılan şey metin içeriği, dosya adı ve ona verilen bağlantılardır.
Özetle
PDF metadata'sı, sayfada görünmeyen ama dosyayla birlikte giden bir bilgi katmanıdır ve yazar alanı çoğu zaman farkında olmadan kişisel bilgi taşır. Web'de yayınlayacağınız belgelerde bu alanları doldurmak (özellikle başlık) profesyonellik katar; dışarıya göndereceğiniz hassas belgelerde ise temizlemek gerekir. Temizlik yaparken hem eski Belge Bilgisi sözlüğünün hem de XMP bloğunun ele alındığını doğrulayın. Ve en önemlisi: metadata temizleme, sayfa içeriğindeki bilgiyi kaldırmaz — gizli veri için redaksiyon, form verisi için düzleştirme, sürüm geçmişi için yeniden yazma gerekir.
Sıkça Sorulan Sorular
PDF'te hangi bilgiler saklanıyor, farkında olmadan ne paylaşıyorum?
Tipik olarak başlık, yazar adı, konu, anahtar kelimeler, dosyayı üreten program, oluşturma ve değiştirme tarihleri bulunur. Yazar alanı çoğu zaman Word veya işletim sistemi kullanıcı adınızdan otomatik doldurulur; bu, kişisel adınız veya kurum kullanıcı adınız olabilir. Üretici program bilgisi ise hangi yazılımı ve sürümü kullandığınızı ele verir.
Metadata'yı temizlemek belge içeriğindeki bilgiyi de siler mi?
Hayır. Metadata, belge hakkındaki bilgidir — sayfa içeriğinin parçası değildir. Sayfada görünen isimler, tarihler ve gizli veriler metadata temizlemeyle kaldırılmaz. Sayfa içeriğinden bilgi çıkarmak için redaksiyon aracı gerekir; ikisi tamamen farklı işlerdir ve genellikle ikisini birden yapmak gerekir.
Belge Bilgisi ile XMP arasındaki fark nedir?
Belge Bilgisi (Document Info) sözlüğü, PDF'in eski ve basit meta veri yapısıdır; başlık, yazar gibi birkaç anahtar içerir. XMP ise XML tabanlı, çok daha zengin ve genişletilebilir bir standarttır ve dosyaya gömülü bir metin bloğu olarak durur. Birçok PDF her ikisini birden taşır ve değerler çelişebilir. Temizlik yaparken ikisinin de ele alındığından emin olmak gerekir.
Metadata düzenlemek SEO'ya yardım eder mi?
Web'de yayınlanan PDF'lerde başlık alanı arama sonuçlarında görünen başlığı etkileyebilir ve tarayıcı sekmesinde gösterilir. Bu ölçüde faydası vardır. Anahtar kelime alanının ise arama motorları üzerindeki etkisi uzun süredir yok denecek kadar azdır. Asıl belirleyici olan belgenin metin içeriği, dosya adı ve ona verilen bağlantılardır.
Bu konuyu Metadata Düzenle/Temizle aracıyla hemen deneyin.
Metadata Düzenle/Temizle aracını dene