In breve
Questo strumento rimuove i metadati standard da un PDF — il dizionario Info e il pacchetto XMP — interamente nel tuo browser usando pdf-lib in puro JavaScript. Ciò cancella autore, titolo, oggetto, parole chiave, l'applicazione che l'ha creato e le marche temporali di creazione/modifica, quindi risalva il file. È onesto sull'ambito: agisce sui metadati standard del documento e nongarantisce la rimozione di ogni traccia incorporata. Nulla viene caricato — la scheda Rete lo dimostra.
Dove un PDF nasconde i metadati
Un PDF registra i dati descrittivi in due posti standard. Ildizionario Info è il classico insieme di campi:Author, Title, Subject,Keywords, Creator, Producer e le marche temporali CreationDate/ModDate. Il pacchetto XMP è un blocco XML che contiene le stesse informazioni più tutto ciò che il software di authoring ha scelto di aggiungere — Acrobat, InDesign, l'esportazione da Word e gli strumenti di design scrivono tutti qui. Questo strumento cancella entrambi, il che rimuove i metadati che la stragrande maggioranza dei visualizzatori, degli strumenti di ricerca e degli ispettori legge.
L'avvertenza onesta: cosa può persistere
Non faremo finta che rimuovere i metadati standard renda un documento anonimo dal punto di vista forense. Svuotare il dizionario Info e l'XMP è l'operazione giusta e attesa, ma un PDF può contenere dati identificativi in posti che questo passaggio non raggiunge: dati EXIF all'interno di immagini incorporate, informazioni nascoste neiflussi di oggetti, livelli oannotazioni nascoste e — cosa più ovvia — qualsiasi cosa stampata nel contenuto visibile di una pagina stessa. Se il tuo modello di minaccia è reale (whistleblowing, ambito legale, sicurezza personale), la via più sicura è appiattire il documento in immagini e ricostruirlo, e rivedere il risultato. Questo strumento rimuove i metadati standard in modo pulito; non promette, e onestamente non può promettere, di più.
Perché qui il senza-caricamento è l'intero punto
Rimuovere i metadati identificativi è un'azione a tutela della privacy — quindi caricare il file su un server per farlo sarebbe controproducente: il documento originale, con tutti i suoi metadati intatti, finirebbe su un'infrastruttura che non puoi ispezionare prima che venga rimosso qualcosa. Questo strumento non compie mai quel passo. pdf-lib funziona nella tua scheda, il file viene letto dal disco e riscritto in locale, e nessuna richiesta trasmette i tuoi byte. Apri DevTools, osserva la scheda Rete e verifica che il file resti sulla tua macchina.
File cifrati o danneggiati
Un PDF cifrato deve essere decifrato prima che i suoi metadati possano essere riscritti — lo strumento rileva la cifratura e ti indirizza aSblocca PDF prima. Se invece un file non viene interpretato, potrebbe essere danneggiato a livello strutturale, e la rimozione può riscrivere solo un documento che riesce a leggere. Sembra danneggiato? Diagnosticalo e riparalo, poi pulisci qui la copia riparata.