Preguntas sobre metadatos PDF
Títulos, autores, XMP, privacidad y qué hacen con todo ello los buscadores.
¿Cómo edito los metadatos de un PDF?+
Abre el PDF en el espacio de trabajo de arriba, cambia los campos que quieras (título, autor, asunto, palabras clave, creador, productor, fecha de creación o fecha de modificación) y pulsa Descargar. Deja un campo vacío para eliminarlo. Los campos que no tocas se escriben exactamente como estaban, y la copia guardada se vuelve a abrir y se comprueba antes de descargarse.
¿Cómo cambio el título que muestra un PDF en la pestaña del navegador?+
Muchos visores de PDF, incluidos algunos integrados en los navegadores web, muestran el campo Título del documento en la pestaña o en la barra de título en lugar del nombre del archivo cuando hay un título definido. Edita aquí el campo Título y descarga la copia. Si el espacio de trabajo indica que hay un flujo de metadatos XMP, algunos visores, entre ellos Firefox, leen el título de ahí, así que marca también Eliminar el flujo XMP al guardar. Para pedir a los lectores de escritorio como Adobe Acrobat que prefieran el título al nombre del archivo, activa también Mostrar el título en lugar del nombre del archivo, que define la preferencia de visualización DisplayDocTitle. Cada lector decide por su cuenta cómo usarla.
¿Cómo elimino el nombre del autor de un PDF?+
Vacía el campo Autor y descarga. Si el espacio de trabajo indica que hay un flujo de metadatos XMP, que a menudo repite el autor, marca también Eliminar el flujo XMP al guardar o cambia a Eliminar todo. Los nombres también pueden estar en otras partes de un PDF, por ejemplo en comentarios y anotaciones, y esta herramienta no los modifica.
¿Qué pueden revelar los metadatos de un PDF?+
Más de lo que la mayoría espera. El autor suele rellenarse automáticamente a partir de una cuenta de trabajo o del nombre del equipo, Creador y Productor indican el software y a menudo su versión, y las dos fechas muestran cuándo se creó el documento y cuándo se guardó por última vez. Las entradas personalizadas pueden contener nombres de empresas o referencias internas. Vale la pena revisarlos antes de que un PDF salga de tu organización.
¿Qué son los metadatos XMP?+
XMP (Extensible Metadata Platform) es un bloque de XML guardado como flujo dentro del PDF. Suele repetir el título, el autor y las fechas del diccionario de información y puede contener mucho más, como declaraciones de derechos, historial de edición y detalles de conformidad con PDF/A. Este editor muestra si existe un flujo XMP a nivel de documento y qué tamaño tiene. Eliminar todo lo borra. En el modo de edición se conserva salvo que decidas eliminarlo, porque el editor no reescribe el XMP.
¿Por qué Productor dice pdf-lib u otra aplicación?+
Productor registra el software que escribió el PDF. Muchas herramientas PDF en línea se basan en la biblioteca de código abierto pdf-lib, que por defecto escribe su propio nombre en Productor y actualiza la fecha de modificación cada vez que guarda. Los conversores, las impresoras virtuales y las suites ofimáticas registran su nombre del mismo modo. Este editor desactiva ese comportamiento predeterminado, así que Productor termina siendo lo que escribas o se omite por completo.
¿Editar los metadatos cambia el contenido de mi PDF?+
No se vuelve a dibujar ninguna página, y el texto, las imágenes y las fuentes no se recomprimen ni se vuelven a renderizar. Aun así, el archivo se reescribe entero, así que su estructura interna se reorganiza y el tamaño puede variar un poco, tanto hacia arriba como hacia abajo. Como con cualquier edición de un PDF, una firma digital deja de ser válida.
¿Importan los metadatos de un PDF para los buscadores?+
Pueden ayudar. Cuando un PDF se publica en la web, los buscadores pueden usar su campo Título como título del resultado, y un título claro también ayuda a reconocer el archivo en una pestaña del navegador o en una lista de descargas. Los buscadores posicionan un PDF sobre todo por su texto, así que trata los metadatos como un etiquetado preciso y no como un atajo de posicionamiento, y no esperes que el campo Palabras clave mejore tu posición.
¿Qué deja atrás Eliminar todo?+
Elimina el diccionario de información del documento, incluidas las entradas personalizadas, y el flujo XMP a nivel de documento, y después descarta los objetos a los que ya nada hace referencia. Otras partes de un PDF también pueden contener datos identificativos y no las alcanza, por ejemplo los metadatos de las imágenes y fuentes incrustadas (como el EXIF de una foto), los flujos de metadatos de páginas concretas, los datos de aplicaciones guardados como PieceInfo (como los datos de edición de Illustrator), los nombres en los comentarios, los valores de los campos de formulario, los marcadores, los adjuntos y el identificador del archivo. Los PDF cifrados o protegidos con contraseña se rechazan en lugar de procesarse.
¿Se sube mi PDF?+
No. El archivo lo lee y lo reescribe pdf-lib, que se ejecuta en esta pestaña del navegador. No se envía nada a un servidor ni se guarda nada, y el espacio de trabajo se vacía al cerrar o recargar la página.