En resumen
Esto elimina los metadatos estándar de un PDF — el diccionario Info y el paquete XMP — por completo en tu navegador usando pdf-lib, escrito íntegramente en JavaScript. Eso vacía el autor, el título, el asunto, las palabras clave, la aplicación que lo creó y las marcas de tiempo de creación/modificación, y luego vuelve a guardar el archivo. Es honesto en cuanto a su alcance: apunta a los metadatos estándar del documento y no garantiza la eliminación de todo rastro incrustado. Nada se sube — la pestaña Red lo demuestra.
Dónde esconde un PDF los metadatos
Un PDF registra datos descriptivos en dos lugares estándar. Eldiccionario Info es el conjunto clásico de campos:Author, Title, Subject,Keywords, Creator, Producer y las marcas de tiempo CreationDate/ModDate. El paquete XMP es un bloque XML que lleva la misma información más todo lo que el software de autoría haya decidido añadir — Acrobat, InDesign, la exportación de Word y las herramientas de diseño escriben todos aquí. Esta herramienta vacía ambos, lo que elimina los metadatos que lee la inmensa mayoría de visores, herramientas de búsqueda e inspectores.
La advertencia honesta: qué puede persistir
No vamos a fingir que eliminar los metadatos estándar convierte un documento en algo anónimo a nivel forense. Vaciar el diccionario Info y el XMP es la operación correcta y esperable, pero un PDF puede llevar datos identificativos en lugares que esta pasada no alcanza:datos EXIF dentro de imágenes incrustadas, información metida en flujos de objetos, capas oanotaciones ocultas y — lo más evidente — cualquier cosa impresa en el contenido visible de una página. Si tu modelo de amenaza es real (filtraciones, asuntos legales, seguridad), la ruta más segura es aplanar el documento a imágenes y reconstruirlo, y revisar el resultado. Esta herramienta elimina los metadatos estándar de forma limpia; no promete, y no puede prometer con honestidad, nada más.
Por qué el «sin subida» es aquí lo esencial
Eliminar metadatos identificativos es una acción de privacidad — así que subir el archivo a un servidor para hacerlo sería contraproducente: el documento original, con todos sus metadatos etiquetados, aterrizaría en una infraestructura que no puedes inspeccionar antes de que se eliminara nada. Esta herramienta nunca da ese paso. pdf-lib se ejecuta en tu pestaña, el archivo se lee del disco y se reescribe en local, y ninguna petición transmite tus bytes. Abre las DevTools, observa la pestaña Red y comprueba que el archivo se queda en tu máquina.
Archivos cifrados o dañados
Un PDF cifrado debe descifrarse antes de que se puedan reescribir sus metadatos — la herramienta detecta el cifrado y te dirige aDesbloquear PDF primero. Si en cambio un archivo no se puede analizar, puede que esté dañado estructuralmente, y la eliminación solo puede reescribir un documento que puede leer. ¿Parece dañado? Diagnostícalo y repáralo, y luego limpia aquí la copia reparada.