Kurz gesagt
Dies entfernt die Standard-Metadaten aus einem PDF — das Info-Dictionaryund das XMP-Paket — vollständig in deinem Browser mit dem reinen JavaScript pdf-lib. Das löscht Autor, Titel, Betreff, Schlüsselwörter, die erstellende Anwendung und die Erstellungs-/Änderungszeitstempel und speichert die Datei dann neu. Es ist ehrlich über den Umfang: Es zielt auf Standard-Dokumentmetadaten und garantiert nicht die Entfernung jeder eingebetteten Spur. Nichts wird hochgeladen — der Netzwerk-Tab beweist es.
Wo ein PDF Metadaten versteckt
Ein PDF speichert beschreibende Daten an zwei Standard-Orten. DasInfo-Dictionary ist der klassische Satz von Feldern:Author, Title, Subject,Keywords, Creator, Producer und dieCreationDate/ModDate-Zeitstempel. DasXMP-Paket ist ein XML-Block, der dieselben Informationen trägt, plus alles, was die Erstellungssoftware hinzufügen wollte — Acrobat, InDesign, Word-Export und Design-Tools schreiben alle hierher. Dieses Tool löscht beides, was die Metadaten entfernt, die die überwältigende Mehrheit der Viewer, Suchwerkzeuge und Inspektoren liest.
Der ehrliche Vorbehalt: was bestehen bleiben kann
Wir tun nicht so, als mache das Löschen der Standard-Metadaten ein Dokument forensisch anonym. Das Info-Dictionary und XMP zu leeren ist der richtige, erwartete Vorgang, aber ein PDF kann identifizierende Daten an Orten tragen, die dieser Durchlauf nicht erreicht: EXIF-Daten in eingebetteten Bildern, Informationen, die in Object-Streamsstecken, versteckte Ebenen oder Anmerkungenund — am offensichtlichsten — alles, was in den sichtbaren Inhalt einer Seite selbst gedruckt ist. Wenn dein Bedrohungsmodell real ist (Whistleblowing, rechtlich, Sicherheit), ist der sicherste Weg, das Dokument in Bilder zu überführen und neu aufzubauen und das Ergebnis zu überprüfen. Dieses Tool entfernt Standard-Metadaten sauber; es verspricht nicht, und kann ehrlicherweise nicht mehr versprechen.
Warum „kein Hochladen“ hier der ganze Sinn ist
Identifizierende Metadaten zu entfernen ist eine Datenschutz-Handlung — die Datei zum Erledigen auf einen Server hochzuladen wäre also selbstschädigend: Das ursprüngliche, vollständig mit Metadaten versehene Dokument würde auf Infrastruktur landen, die du nicht einsehen kannst, bevor irgendetwas entfernt wurde. Dieses Tool macht diesen Schritt nie. pdf-lib läuft in deinem Tab, die Datei wird von der Festplatte gelesen und lokal neu geschrieben, und keine Anfrage überträgt deine Bytes. Öffne die DevTools, beobachte den Netzwerk-Tab und bestätige, dass die Datei auf deinem Gerät bleibt.
Verschlüsselte oder beschädigte Dateien
Ein verschlüsseltes PDF muss entschlüsselt werden, bevor seine Metadaten neu geschrieben werden können — das Tool erkennt die Verschlüsselung und verweist dich zuerst auf PDF entsperren. Wenn eine Datei stattdessen nicht geparst werden kann, ist sie womöglich strukturell beschädigt, und das Löschen kann nur ein Dokument neu schreiben, das es lesen kann. Sieht beschädigt aus? Diagnostiziere & repariere es, dann reinige die reparierte Kopie hier.