Cosa rivelano i metadati del vostro PDF
Un PDF è più delle sue pagine visibili. Trasporta un dizionario di metadati che può registrare chi lo ha creato, quale software è stato usato, quando è stato fatto e quando è stato modificato per l' ultima volta. Prima di condividere un documento, vale la pena sapere cosa dicono questi metadati.
Le basi
Campi di metadati comuni
Il dizionario di informazione standard di un PDF può contenere:
- Title — il titolo del documento, spesso impostato automaticamente dal primo titolo o dal nome del file sorgente.
- Author — il nome dell'autore, frequentemente recuperato dall'account utente del sistema operativo o dal profilo del software d'ufficio.
- Subject — una breve descrizione o riga di oggetto.
- Creator — l'applicazione di origine che ha prodotto il documento (p. es. «Microsoft Word 365»).
- Producer — il motore PDF che ha scritto il file finale (p. es. «LibreOffice 7.6» o una versione specifica di libreria).
- CreationDate e ModDate — marche temporali che indicano quando il documento è stato creato e modificato per l'ultima volta.
Il rischio
Cosa questo può rivelare
Nessuno di questi campi è malevolo in sé, ma insieme possono tratteggiare un ritratto che non volevate condividere. Il campo Author può contenere un nome reale recuperato dal computer del creatore. I campi Creatore Producer rivelano il software esatto e la versione usata, il che può essere utile per attacchi mirati. Le marche temporali possono indicare quando e a quale velocità un documento è stato redatto, il che è occasionalmente sensibile in contesti legali o commerciali.
Oltre al dizionario standard, i PDF possono anche trasportare metadati XMP — un blocco XML che può includere la cronologia delle revisioni, dei commenti, delle modifiche tracciate, etichette di valutazione e persino coordinate GPS da certe applicazioni di fotocamera o scansione. XMP è più ricco del dizionario standard ed è spesso trascurato.
Oltre i metadati
Altro contenuto nascosto nei PDF
I metadati non sono l'unica cosa che un PDF può trasportare senza che sia visibile sulla pagina. Un PDF può contenere livelli nascosti derivanti da un trattamento OCR (uno strato di testo invisibile su un'immagine scansionata), allegati incorporati nel file, campi modulo nascosti eoggetti eliminati ma non purgati — del contenuto che è stato rimosso dalla pagina ma esiste ancora nel file perché la tabella dei riferimenti incrociati non è stata compattata.
Quest'ultimo caso è una silenziosa violazione della riservatezza. Una bozza di contratto da cui è stato rimosso un paragrafo prima dell'invio può ancora contenere quel paragrafo nel corpo dei oggetti del file, accessibile a chiunque ispezioni i byte grezzi. Un'approfondita operazione di «pulizia» o «redazione» rimuove questi oggetti orfani invece di semplicemente mascherarli. Un semplice azzeramento dei metadati non tratta ciò — è un'operazione distinta.
Azione
Come visualizzare e rimuovere i metadati
La maggior parte dei lettori PDF espone i campi standard in un menu «Proprietà del documento» o «Ottieni info». XMP è più difficile da leggere senza uno strumento dedicato, ma viaggia con il file allo stesso modo.
Per rimuovere i metadati prima di condividere, non avete bisogno di caricare il file da nessuna parte. Uno strumento locale di modifica dei metadatipuò cancellare o sostituire i campi nel vostro browser, producendo una copia pulita senza inviare il documento — né i suoi metadati — sulla rete. È l'approccio più sicuro per documenti sensibili: verificare localmente, poi condividere.
Da leggere anche
Risorse correlate
Da leggere anche