[nonimo]
ES
Descargar

Borrar metadatos de un documento antes de subirlo a la IA

· Escrito y mantenido por Nonimo

Un documento cuenta más cosas de las que enseña. Un Word guarda quién lo escribió, quién lo guardó la última vez, el nombre del despacho, la plantilla de la que salió y a veces la carpeta del servidor donde vive. Un PDF repite parte de eso, y las fotos que lleva dentro, como la del carnet de conducir, pueden decir con qué móvil se hicieron y dónde.

Nada de eso sale en la página, y todo viaja cuando subes el fichero entero a ChatGPT o a Claude. Borrar metadatos de un documento antes de dárselo a una IA es un paso corto, pero tiene dos trampas: el borrado que no borra y la foto que nadie mira. Aquí van las dos, con un Word y un PDF de prueba, para un despacho de abogados o una asesoría.

Borrar metadatos de un documento: lo que el fichero cuenta sin que se vea

Microsoft lo explica en su ayuda sin rodeos: las propiedades del documento, o metadatos, incluyen el autor, el asunto y el título, y también datos que Word rellena solo, como el nombre de quien lo guardó por última vez y la fecha de creación. Si se usaron ciertas funciones, añade encabezados de correo, listas de distribución o nombres de plantilla.

Un fichero .docx, por dentro, es una carpeta comprimida con varias piezas. El texto que ves vive en una de ellas. Las propiedades viven en otras, y las fotos van como ficheros aparte, cada una con sus propios datos. Cuando abres el documento, Word enseña la primera; las demás siguen ahí.

Borrar metadatos de un documento: lo que lleva un .docx además del texto Un fichero .docx es un paquete con varias partes. A la izquierda, la única que se ve en pantalla: el texto del documento. A la derecha, las que no se ven: propiedades básicas con autor y título, propiedades de la aplicación con empresa y plantilla, propiedades personalizadas, la lista de personas con su correo y la foto con sus datos EXIF. Lo que ves El texto del documento Lo que también va dentro Propiedades: autor, último que guardó, título, fechas Aplicación: empresa, plantilla, ruta de los vínculos Propiedades personalizadas: cliente, expediente Personas que comentan, con su correo Fotos, cada una con su cámara, hora y GPS
Las partes de un .docx, simplificadas. Esquema propio a partir del Word de prueba de esta guía

Lo que se rellena solo

Casi nadie escribe a mano el autor de un documento. Word lo rellena solo, a partir del nombre de usuario de Office, y en la tabla del Inspector de Microsoft aparece precisamente así, como «nombre de usuario». La fecha de creación, el tiempo de edición y el número de revisión los lleva el programa sin preguntar.

Por eso el problema no es de descuido. Un documento que nadie ha tocado a propósito ya lleva el nombre de quien lo creó y el de la organización. Y si el escrito nació de una plantilla con el nombre del abogado, o de un modelo que empezó otro compañero, el fichero lo arrastra. En una presentación, la plantilla puede dejar además el nombre del cliente en el patrón de diapositivas.

Lo que se rellena sin querer

Hay otra clase de metadatos que sí escribe una persona, pero pensando en otra cosa. El título es el caso típico: alguien lo rellena una vez, en la plantilla o al archivar, para encontrar el documento después, y lo más fácil de encontrar es el nombre del cliente.

Lo mismo pasa con las palabras clave y las propiedades personalizadas que algunos gestores documentales piden al guardar, como el número de expediente. Son útiles dentro de la oficina, que es para lo que existen, y son exactamente lo que no debería salir de ella.

En una notaría puede ser el número de protocolo de una escritura; en una consulta, el de historia clínica de un informe médico.

La prueba: un Word y un PDF inventados, leídos por un programa

Para no hablar de oídas, preparamos un informe de un despacho que no existe sobre el despido de un cliente que tampoco existe, con un DNI que no es de nadie. Le pusimos las propiedades que tendría un documento real de oficina y una foto hecha con un móvil, con su hora y su posición. Lo guardamos como Word y como PDF.

Después lo leímos con un programa de unas veinte líneas escrito en Python, con bibliotecas de uso corriente. No hace nada especial: abre el fichero y lista lo que encuentra. Es el tipo de programa que cualquiera puede escribir en diez minutos, y esto es lo que devolvió del Word:

Dónde estabaQué contenía
Autor y último que guardóMarta Quiles Ferrándiz · Iván Soler Peris
Título, palabras clave y comentariosDespido de Joan Beltrán Mora · despido, Beltrán · Revisar con Iván antes del juicio
Empresa y plantillaQuiles Abogados Inventados · Bufete - Marta Quiles.dotm
Base de los hipervínculos\\servidor01\clientes\Beltran\2026-0412
Propiedades personalizadasCliente: Joan Beltrán Mora · Expediente 2026/0412
Personas del documentoLa autora y su correo del despacho
Foto del parte de entregaMóvil, 12 de septiembre a las 08:41, GPS 39,4699 N 0,3763 O

Prueba propia del 28 de septiembre de 2026. Todos los nombres, el despacho, el expediente y el correo son inventados.

Lo que no estaba en la página

Nada de esas siete filas aparece en el texto del informe. El cuerpo decía quién era el cliente, con DNI y teléfono, y de qué iba el asunto, y eso lo habría visto cualquiera. Pero el nombre de la abogada, el del compañero que revisó, la carpeta del servidor y el lugar exacto de la foto solo estaban en las partes que no se ven.

Hay un detalle más. Si el cuerpo se hubiera limpiado a conciencia, con el nombre del cliente sustituido en cada línea, el título y la propiedad «Cliente» lo seguirían diciendo. Limpiar el texto y olvidar las propiedades es como cambiar el nombre en el sobre y dejarlo en el remite.

Lo que viaja si pegas solo el texto

Hicimos una segunda lectura: en vez del fichero, solo el texto del cuerpo, que es lo que se copia y se pega en un chat. De la autora, el compañero, el despacho, la plantilla, la ruta y la cámara no quedó nada. Quedaron el cliente y sus datos de contacto, con el DNI, que están en el cuerpo y hay que seudonimizar aparte. Esa diferencia es la que importa para decidir:

Qué sale de tu ordenadorSi subes el ficheroSi pegas el texto
Autora, último que guardó, correoSíNo
Despacho, plantilla y ruta del servidorSíNo
Título y propiedades con el clienteSíNo
Cámara, hora y GPS de la fotoSíNo
Nombre, DNI y teléfono del cuerpoSíSí, hasta que los tapes

Prueba propia con el Word inventado, el 28 de septiembre de 2026.

Por qué importan cuando el fichero entero va a una IA

Cuando arrastras un documento al chat, lo que sale de tu ordenador es el fichero completo, con todas sus partes. Qué hace luego el servicio con él, cuánto lo guarda y si entrena con ello depende del plan, y lo repasan nuestra guía de ChatGPT y la de Claude.

Lo que ni OpenAI ni Anthropic explican en su ayuda es si el modelo lee las propiedades cuando le pides un resumen. No hace falta saberlo para decidir. El fichero ya ha llegado a otra empresa, con el nombre de la autora y la ruta del servidor dentro, y a partir de ahí esos datos están en manos de un tercero. Borrar la conversación no se lleva el fichero: en ChatGPT, la Biblioteca guarda lo subido aparte del chat.

El asistente que ejecuta código

Hay además una vía que no depende de lo que el modelo lea por su cuenta. OpenAI explica en su centro de ayuda que, para algunas tareas de análisis, ChatGPT escribe y ejecuta código Python sobre los archivos subidos. Un programa como el de nuestra prueba es justo eso: unas líneas que abren el fichero y listan sus propiedades. Con un Excel, un programa así saca además las filas y las hojas que tenías ocultas.

Basta con que alguien pregunte «¿quién ha redactado esto?» o «¿de cuándo es este documento?» para que la respuesta salga de los metadatos. No hay que imaginar un ataque: es una pregunta normal sobre un documento.

Los datos de quien trabaja, no solo del cliente

Cuando se habla de datos personales en un documento, se piensa en el cliente. Los metadatos añaden otra lista: la abogada que lo redactó, el compañero que lo guardó, su correo de trabajo, la hora a la que lo imprimieron. Son datos de tu equipo, y salen con el fichero igual que los del cliente.

Si tu oficina tiene por escrito qué se puede subir a un chat, aquí cabe un punto más: el fichero sale sin propiedades o no sale. Encaja con el resto de las reglas de la casa sobre IA.

Borrar metadatos de un documento de Word con el Inspector

Word trae la herramienta, y Microsoft la describe paso a paso en su ayuda en español. La misma página recuerda que Microsoft no tiene acceso a la información de un documento a menos que se lo envíes, algo que conviene tener presente si usas su asistente dentro de Word, como repasa la guía de Copilot.

El Inspector de documento, que así se llama, se usa sobre una copia: Microsoft lo recomienda encarecidamente, porque lo que quita no siempre se puede recuperar. Los pasos, con sus menús tal cual:

  1. Guarda una copia. Archivo, Guardar como, y un nombre nuevo. Todo lo demás se hace sobre la copia.
  2. Abre el Inspector. Archivo, Información, Comprobar si hay problemas e Inspeccionar documento.
  3. Elige qué revisar. Marca Propiedades del documento e información personal, y también Datos XML personalizados.
  4. Inspecciona. Inspeccionar, y revisa lo que encuentra.
  5. Quita. Quitar todo en cada tipo que quieras eliminar, y después Volver a inspeccionar o Cerrar.
Quitar metadatos en Word: el recorrido hasta Inspeccionar documento Cinco pasos en fila: Archivo, Información, Comprobar si hay problemas, Inspeccionar documento y Quitar todo. Todo sobre una copia del documento. Archivo Información Comprobar si hay problemas Inspeccionar documento Quitar todo Siempre sobre una copia: lo que quita no siempre se recupera
Los menús de Word en español. Microsoft, «Quite datos ocultos e información personal inspeccionando documentos»

Lo que el Inspector encuentra en las propiedades

Según la tabla de Microsoft, el inspector de propiedades busca y quita las propiedades del documento, incluidas las pestañas Resumen, Estadísticas y Personalizar, los encabezados de correo, las listas de distribución, la información de envío para revisión, las propiedades del servidor de documentos, el nombre de usuario y el nombre de la plantilla. Los datos XML personalizados tienen su propio inspector.

Antes de quitar, conviene mirar qué había. Archivo, Información, y Mostrar todas las propiedades al pie de la columna: ahí salen autor, empresa, responsable y fechas. Si ves el nombre de un cliente en el título o en las palabras clave, ya sabes que el Inspector tiene trabajo. Y si el Inspector encuentra además comentarios o revisiones, eso no se arregla en las propiedades: los cambios se aceptan y los comentarios se borran antes de volver a inspeccionar.

Lo que no es metadato, aunque el Inspector lo mire

El mismo Inspector revisa comentarios, marcas de revisión, texto oculto y encabezados y pies de página. Todo eso va dentro del documento aunque no se vea, y es terreno de otra guía de esta serie, la del Word por dentro. Aquí basta una advertencia: Microsoft avisa de que el inspector de texto oculto no detecta el texto blanco sobre fondo blanco.

Y una propiedad puede dejar de ser invisible. Word permite insertar el autor o el nombre del fichero como campo en un encabezado. Si alguien lo hizo en la plantilla, el nombre está en cada página, y quitar la propiedad no lo borra de ahí.

Ver y vaciar las propiedades de un PDF en Acrobat

En un PDF, las propiedades se ven en Acrobat con Archivo y Propiedades, en la pestaña Descripción. El INCIBE, en su guía para empresas sobre metadatos, indica además el botón Metadatos adicionales, que abre el bloque XMP: una segunda copia de esos datos, en otro formato, dentro del mismo fichero. Dónde mirar cada cosa, en resumen:

Qué quieres verDóndeSegún
Propiedades de un WordArchivo, Información, Mostrar todas las propiedadesMicrosoft
Propiedades de un PDFAcrobat: Archivo, Propiedades, pestaña DescripciónINCIBE
Bloque XMP de un PDFEl botón Metadatos adicionales, en esa pestañaINCIBE
Cualquier fichero, en WindowsBotón derecho, Propiedades, pestaña DetallesINCIBE

Esa segunda copia es la primera trampa del PDF. En el nuestro, el autor y el título estaban en las propiedades clásicas y otra vez en el XMP. Un programa que vacía unas y no el otro deja el nombre donde otro lector lo encontrará.

Lo que hereda el PDF del Word

Un PDF exportado desde Word puede traer sus propiedades: autor, título, a veces el asunto. Si el Word no se limpió antes, el PDF sale con lo mismo. Por eso el orden sensato es limpiar el Word con el Inspector, exportar después, y mirar las propiedades del PDF resultante antes de mandarlo a ningún sitio.

Adobe incluye en el recorrido de su herramienta Censurar un último paso, Continuar, que según su tutorial en español quita la información que no se ve, como comentarios, metadatos o capas ocultas, y guarda un fichero nuevo. Es de Acrobat Pro, Premium y Studio. Tapar datos del cuerpo de un PDF es otro asunto, y lo cuenta la guía de anonimizar un PDF.

El autor que sigue dentro: la actualización incremental del PDF

Esta es la trampa que menos se conoce. Un PDF admite que los cambios se guarden añadiéndolos al final del fichero, sin tocar lo que ya había. Es rápido y está previsto en el propio formato, pero significa que el autor que acabas de vaciar sigue escrito unas líneas más arriba, en la versión anterior.

No es una teoría nuestra. ExifTool, la herramienta de metadatos que enseña a usar el propio INCIBE, lo dice en su documentación: sus cambios en un PDF usan esa técnica, son reversibles y la información antigua nunca se borra del fichero. La misma página propone reescribirlo con otra herramienta para quitarla de verdad.

Lo que medimos en la prueba

Lo comprobamos con el PDF de prueba. Dejamos en blanco el autor, el título, el asunto y las palabras clave, quitamos el bloque XMP y guardamos añadiendo el cambio al final. Un lector de PDF ya no enseñaba nada en las propiedades. Pero el nombre de la autora seguía escrito en los bytes del fichero las mismas veces que antes.

4veces el nombre de la autora en el PDF original
4tras vaciar las propiedades y guardar al final
0tras reescribir el fichero entero
Apariciones del nombre en los bytes del PDF de prueba. Prueba propia del 28 de septiembre de 2026

Para asegurarnos de que no era un recuento vacío, cortamos el fichero justo donde terminaba la revisión anterior y lo abrimos. Autor y título volvieron, enteros. Después reescribimos el PDF completo, descartando lo que ya no se usaba, y el nombre desapareció de los bytes. Si un PDF así ya salió hacia un chat con el nombre dentro, lo que toca después está en qué hacer si el dato ya salió.

Cómo se evita sin saber de formatos

No hace falta entender la estructura del PDF para esquivarlo. La regla práctica es que el fichero limpio sea un fichero nuevo, no el mismo guardado encima. En Acrobat, el Continuar de la herramienta Censurar ya guarda en un archivo nuevo. Con otros programas, busca una opción que genere un fichero nuevo en vez de guardar encima, y comprueba el resultado igual.

La comprobación casera es sencilla: abre el PDF limpio con el Bloc de notas o cualquier editor de texto y busca el apellido. En un fichero comprimido puede que no aparezca aunque esté, así que un cero ahí no prueba nada; un resultado positivo, en cambio, sí prueba que el nombre sigue dentro.

Las fotos de dentro: EXIF, cámara y ubicación GPS

Las fotos hechas con un móvil, como la de tu carnet de conducir, guardan, dentro de la propia imagen, un bloque de datos llamado EXIF: marca y modelo del teléfono, fecha y hora exactas y, si la ubicación estaba activada, las coordenadas del sitio. El INCIBE pone ese ejemplo, la foto del móvil con sus coordenadas GPS, para explicar qué es un metadato.

Cuando esa foto se pega en un Word o en un PDF, puede entrar tal cual, con su EXIF. En nuestro Word de prueba, así fue. La foto del parte de entrega llevaba el modelo de móvil, la hora a la que se hizo y la posición.

39,4699 N · 0,3763 O
coordenadas GPS que seguían dentro de la foto del PDF de prueba tras vaciar sus propiedades. Prueba propia del 28 de septiembre de 2026

Vaciar las propiedades no toca la foto

Esa es la segunda trampa, y la prueba la enseña sin matices. En el PDF con las propiedades vaciadas, y también en el reescrito de arriba abajo, la foto seguía diciendo dónde y cuándo se hizo. Las propiedades del documento y los datos de una imagen son cosas distintas, y limpiar unas no limpia los otros.

Para borrar metadatos de un documento con fotos, lo que sí funcionó fue sustituir la foto por una copia sin EXIF antes de montar el documento. El PDF hecho así no tenía coordenadas ni modelo de móvil. Es la solución menos técnica: limpiar la imagen antes de insertarla, no el documento después.

Cuando la foto es el documento

En una clínica o en una aseguradora es normal que el documento sea, en buena parte, fotos: una lesión, un parte, un vehículo. Ahí el EXIF puede decir dónde vive un paciente o a qué hora estaba en un sitio. Y la propia imagen puede enseñar más de lo que parece, como pasa con la foto de un DNI. Si la foto va directa a un chat, ninguno de los cuatro grandes asistentes dice si conserva su EXIF: lo hemos mirado uno a uno.

La misma pestaña Detalles del Explorador sirve para mirar una foto suelta antes de insertarla. Es el momento bueno para limpiarla: antes de que entre en el documento, no después.

El Explorador de Windows y otras vías para quitar metadatos

Si no tienes Acrobat Pro o el fichero no es de Word, Windows deja al menos mirar. El INCIBE describe el camino en el propio Explorador: botón derecho sobre el fichero, Propiedades y pestaña Detalles, donde se ven los metadatos que acompañan al documento. Si el fichero es un .odt, LibreOffice tiene su propia casilla para quitar tu nombre al guardar, pero sola no basta para dejar limpio un .odt de Writer antes de subirlo.

Sirve bien para un vistazo rápido antes de subir algo. Pero enseña lo que Windows sabe leer, que no es todo: el correo de quien comenta un Word o el EXIF de una foto que va dentro de un PDF son partes del fichero que esa pestaña no lista.

Las webs que prometen limpiar

El INCIBE desaconseja las páginas web que eliminan metadatos, porque hay que subirles el documento sin saber si lo tratarán con confidencialidad o lo usarán para otros fines. De cualquier servicio en línea, lo que conviene saber es qué se envía, si se queda guardado y quién tiene acceso. Si el documento es delicado, como un informe médico o un escrito con secreto profesional, la app de Nonimo prepara la copia limpia en tu propio ordenador, y el documento no se mueve de ahí.

ExifTool, la herramienta gratuita que el INCIBE sí enseña a usar, trabaja en tu ordenador y lee casi cualquier formato. Tiene el matiz que ya vimos: en un PDF, lo que borra se puede recuperar hasta que el fichero se reescribe.

Antes de subirlo: comprobar que el fichero sale limpio

Borrar metadatos de un documento no se da por hecho sin mirar el resultado. La comprobación se hace sobre el fichero que vas a subir, no sobre el que tenías abierto, y lleva un par de minutos:

  1. ¿Salen autor, empresa o un nombre de cliente en Archivo, Información o en Propiedades?

    SíVuelve al Inspector de documento o vacía las propiedades del PDF.

    NoMira el bloque de metadatos adicionales si es un PDF.

  2. ¿Lleva fotos hechas con un móvil o una cámara?

    SíSustitúyelas por copias sin EXIF antes de exportar.

    NoSigue con el nombre del fichero.

  3. ¿El nombre del fichero dice de quién trata?

    SíRenómbralo: viaja con el fichero.

    NoEl fichero puede salir.

Todo sobre la copia que vas a subir, guardada como fichero nuevo.

La comprobación antes de subir un documento. Elaboración propia

Lo que esta comprobación no cubre

Mirar las propiedades no dice nada del cuerpo del documento, que sigue teniendo los nombres, los DNI y los importes que escribiste, ni de lo que hay dentro del Word sin verse, como comentarios o cambios sin aceptar. Esas son otras dos revisiones, y ninguna sustituye a esta. En un PDF, la del cuerpo es copiar, pegar y buscar, y la explica la guía del PDF.

Tampoco dice si el conjunto identifica a alguien. Un informe sin nombre, con la fecha del despido, la empresa y el puesto, puede señalar a una persona concreta igual que su DNI. Esa lectura, la de alguien que conoce el caso, no la hace ninguna herramienta.

El nombre del autor también es un dato personal

El RGPD no menciona los metadatos, pero su artículo 4 define dato personal como toda información sobre una persona física identificada o identificable. El nombre de la abogada que firmó el borrador lo es. Su correo de trabajo, también. Y el título que nombra al cliente es un dato del cliente, aunque esté en una casilla que nadie abre.

Con esa definición, el artículo 5.1.c) hace el resto al pedir que se minimice: no se tratan más datos de los que pide el fin. Para pedirle a una IA que revise la redacción de un escrito, sobran la autora, la carpeta del servidor y la posición de la foto. Qué proveedor da garantías por contrato, plan por plan, está en la comparativa de cuentas de empresa.

Lo que ya exige el ENS

En el sector público la obligación está escrita. El Esquema Nacional de Seguridad, en su medida de limpieza de documentos, manda quitar de los documentos lo que llevan de más, sean campos ocultos, metadatos, comentarios o versiones previas, salvo que le sea pertinente a quien lo recibe. Se aplica en todos los niveles, y afecta también a quien trabaja para un ayuntamiento.

Esa excepción, «pertinente para el receptor», es una buena pregunta para cualquier oficina, sea o no pública. Al proveedor de un chat no le es pertinente quién redactó el documento, desde qué carpeta del servidor ni dónde se hizo la foto del parte.

Con la app de Nonimo, la respuesta sin subir el fichero

Cuando lo que te hace falta es la respuesta, no el documento, lo más limpio es no subir el fichero. Sueltas el documento en la app y te enseña el texto con los datos tapados, listo para pegar, y desde ahí puedes descargar una copia tapada. Este es el cuerpo del Word de prueba después de pasar por Nonimo:

ANTES (el texto del Word de prueba)
Cliente: Joan Beltrán Mora, DNI 00000000T.
Teléfono: 000 00 00 00 · Correo: joan.beltran@example.com
Asunto: despido disciplinario comunicado el 15 de septiembre de 2026.

DESPUÉS (Nonimo)
Cliente: [PERSONA_1], DNI [DNI_1].
Teléfono: [TELEFONO_1] · Correo: [CORREO_1]
Asunto: despido disciplinario comunicado el 15 de septiembre de 2026.

Todo es inventado: ninguno de esos datos es de nadie.

El texto no arrastra autor, empresa, plantilla ni foto. En la copia de un Word, la app vacía el autor, el último que lo guardó, la empresa y el responsable, tapa el título, el asunto, las palabras clave y las propiedades personalizadas, y las imágenes van sin sus metadatos. Un PDF vuelve como uno nuevo, solo con el texto y sin los metadatos del original. Al volver la respuesta, la app repone los datos en tu pantalla: es seudonimizar, no anonimizar.

El Inspector de documento va primero, para el nombre de la plantilla y las fechas de comentarios y revisiones. Lo que la app guarda en tu equipo y lo único que envía, un recuento diario que no lleva texto, se cuenta en nuestra página de seguridad.

Fuentes

Nonimo es el software que hace esto en tu propio ordenador: tapa nombres, DNI y expedientes antes de que el texto llegue a ChatGPT. Sin cuenta, y la app lo hace sin que los datos de tus clientes salgan de tu equipo.

Preguntas frecuentes

¿Cómo borrar metadatos de un documento antes de dárselo a una IA?

En Word, con Archivo, Información, Comprobar si hay problemas e Inspeccionar documento, y Quitar todo en las propiedades, sobre una copia. En un PDF, vaciando las propiedades y guardando el fichero entero de nuevo, no solo el cambio. Después se comprueba abriendo las propiedades otra vez. Si lo que necesitas es una respuesta y no el fichero, Nonimo te da el texto con los datos tapados, que no arrastra ninguna propiedad.

¿Qué información oculta guarda un .docx en sus propiedades?

Según Microsoft, el autor, el título, el asunto y datos que Word rellena solo, como quien guardó el documento por última vez y la fecha de creación, además de nombres de plantilla o listas de distribución. En nuestro Word de prueba había también la empresa, una ruta del servidor y el correo de la autora. La copia que devuelve la app de Nonimo vacía el autor, el último que guardó, la empresa y el responsable.

¿Dónde se ven las propiedades de un PDF?

En Acrobat, en Archivo y Propiedades, pestaña Descripción; el botón Metadatos adicionales enseña el bloque XMP, que puede repetir autor y título. En Windows también sirve el Explorador: botón derecho, Propiedades y pestaña Detalles. Una foto incrustada lleva además sus propios metadatos, que ahí no salen. Nonimo, con un PDF, devuelve uno nuevo con solo el texto y sin las propiedades del original.

¿Basta con dejar en blanco el autor en Propiedades?

No siempre. Un PDF admite guardar un cambio añadiéndolo al final, y entonces la versión anterior sigue dentro; ExifTool, por ejemplo, trabaja así y lo avisa en su documentación. En nuestra prueba, el autor vaciado reapareció entero al cortar el fichero por la revisión anterior. Hay que reescribir el fichero completo. Si lo que subes es el texto limpio que te da Nonimo, ese problema no existe.

¿Puede una foto dentro del documento decir dónde se hizo?

Sí, si conserva sus datos EXIF. En nuestra prueba, la foto metida en un Word y en un PDF seguía llevando la marca del móvil, la hora y unas coordenadas GPS del centro de Valencia, y vaciar las propiedades del PDF no las tocó. Hay que limpiar la foto antes de insertarla o sustituirla. En la copia de un Word que da la app de Nonimo, las imágenes van sin sus metadatos.

¿El nombre del autor de un fichero es un dato personal?

Sí. El artículo 4 del RGPD llama dato personal a toda información sobre una persona identificada o identificable, y el nombre de quien redactó un informe lo es, igual que su correo. Si además el título o una propiedad nombran al cliente, el dato es del cliente. La app de Nonimo vacía o tapa esas propiedades en la copia de un Word.

¿Se pueden recuperar unos metadatos ya borrados?

Depende de cómo se guardó el cambio. Si el programa añadió la edición al final del PDF, sí: la documentación de ExifTool dice que sus cambios en un PDF son reversibles y que la información antigua no se borra. En nuestra prueba, reescribir el fichero dejó cero rastros del nombre. Nonimo, con un PDF, no edita el original: genera uno nuevo con solo el texto.

¿Qué quita Nonimo de la copia de un Word?

La app vacía el autor, la última persona que lo guardó, la empresa y el responsable; tapa el título, el asunto, la descripción, las palabras clave, la categoría y las propiedades personalizadas; quita la lista de personas del documento con su correo, la miniatura y los datos XML personalizados, y las imágenes van sin sus metadatos. Para el nombre de la plantilla y las fechas de comentarios y revisiones, pasa antes el Inspector de documento.