[nonimo]
ES
Descargar

Anonimiza un PDF para la IA en segundos

· Actualizado el · Escrito y mantenido por Nonimo

Un PDF con recuadros negros parece limpio, y casi nunca lo está. Si el recuadro se dibujó encima del texto, el nombre, el DNI y la cuenta siguen dentro del fichero, y cualquier programa que extraiga el texto los recupera. ChatGPT y Claude, al recibir un PDF, trabajan con ese texto.

Así que cómo anonimizar un PDF antes de subirlo a una IA tiene una respuesta corta: hay que borrar el texto, no taparlo, y luego comprobarlo. Lo enseñamos con un PDF de prueba, con la herramienta que Adobe llama Censurar y con las salidas que quedan sin Acrobat Pro. Vale para el requerimiento de un despacho de abogados y para la nómina de una asesoría.

Cómo anonimizar un PDF: por qué el recuadro negro no borra nada

Un PDF no es una foto de una página. Es una lista de instrucciones: escribe estas letras en esta posición, con esta fuente; dibuja aquí una línea; pinta allí un rectángulo. Cuando un visor abre el fichero, ejecuta esas instrucciones por orden y te enseña el resultado. Lo que ves es la suma de todo, pero cada cosa sigue guardada por separado.

Por eso un rectángulo negro dibujado encima de un nombre no quita el nombre. Añade una instrucción más, que se pinta después y lo cubre en la pantalla. Las letras de debajo siguen en su sitio, con su fuente y su posición, y cualquier programa que lea el fichero en busca de texto las encuentra como si nada.

Cómo anonimizar un PDF: el recuadro negro es una capa encima del texto, no un borrado A la izquierda, lo que enseña la pantalla: el rótulo Arrendataria y un recuadro negro. A la derecha, lo que guarda el fichero: la capa de texto con el nombre completo y, por separado, el rectángulo dibujado encima. Una herramienta que extrae el texto lee la capa de texto. Lo que ves Arrendataria: Lo que guarda el fichero Dibujo: rectángulo negro en x, y Texto: Arrendataria: Nerea Albiñana Coloma Lo que extrae una herramienta: el nombre
La pantalla suma las capas; la extracción de texto solo lee una. Esquema propio a partir de la prueba de esta guía

Tachar, resaltar y comentar no son censurar

El castellano no ayuda. «Tachar» se usa para todo: para la raya que atraviesa una palabra, para el rotulador negro de una fotocopia y para lo que hacen los programas de PDF. Pero en un programa hay tres gestos distintos, y solo uno quita el dato.

El primero es dibujar: una forma rellena de negro colocada sobre la página. El segundo es comentar: un rectángulo, un resaltado o un tachado que el programa guarda como anotación, aparte del contenido. El tercero es censurar, que es como traduce Adobe la palabra inglesa redact: marcas lo que quieres quitar, aplicas, y el programa elimina esas letras del fichero y deja un recuadro en su lugar. Los dos primeros tapan; solo el tercero borra.

El papel que se tacha con rotulador

En papel, el rotulador negro sí funciona, porque no hay capa debajo: la tinta cae sobre la tinta. El problema empieza cuando el hábito pasa a la pantalla. Quien lleva años tachando fotocopias del DNI o del carnet de conducir hace lo mismo con la herramienta de rectángulo del lector de PDF, guarda y da el trabajo por hecho.

Si el documento va a una IA, esa confusión cuesta cara, porque la IA no mira el negro: lee el texto. Cuánto tiempo guarda OpenAI un archivo subido a ChatGPT es asunto de otra guía; aquí basta con saber que el dato ha salido de tu ordenador.

La prueba: un PDF tachado y lo que queda en su capa de texto

Para no depender de lo que diga nadie, hicimos la prueba. Escribimos un requerimiento de pago inventado, como los que salen de una inmobiliaria que gestiona alquileres, dirigido a una arrendataria que no existe, con seis datos que tapar: el nombre, el DNI, el domicilio, el teléfono, el correo y una cuenta bancaria. El DNI 00000000T y la cuenta, hecha de ceros, no son de nadie.

Después lo tapamos de siete maneras y extrajimos el texto de cada fichero con dos bibliotecas de uso corriente, pypdf y PyMuPDF. Es lo que hace cualquier programa que convierte un PDF en texto: recorrer las instrucciones y quedarse con las letras. El resultado, en los 403 caracteres del original, no deja lugar a dudas.

Cómo se tapóTexto extraído¿Aparece el DNI al buscar?
Sin tapar (el original)403 caracteresSí
Rectángulo negro dibujado403 caracteresSí
Rectángulo negro como comentario403 caracteresSí
Censura aplicada238 caracteres, sin los seis datosNo
Escaneado sin OCR (solo imagen)0 caracteresNo
Escaneado con capa de OCR y rectángulos402 caracteresSí
Rectángulos y página pasada a imagen0 caracteresNo

Prueba propia, 28 de septiembre de 2026, con pypdf 6.10 y PyMuPDF 1.26. La capa de OCR se simuló con las palabras del original.

Lo que devuelve el rectángulo dibujado

El segundo fichero es el que hace casi todo el mundo, y en pantalla se ve impecable: seis bandas negras donde estaban los datos. Su texto extraído es idéntico al del original, letra a letra. «Arrendataria: Nerea Albiñana Coloma», «DNI: 00000000T», la cuenta completa. Buscar el DNI dentro del PDF lo encuentra a la primera.

El tercero, con los rectángulos guardados como comentario, da lo mismo. Es lo que suelen producir las herramientas de comentario de los lectores gratuitos, y a efectos del texto es invisible: el programa que extrae no mira las anotaciones, mira el contenido.

403caracteres en el PDF original
403con los seis recuadros negros dibujados
238después de censurar
Texto extraído del requerimiento de prueba. Pruebas propias, 28 de septiembre de 2026

Lo que devuelve la censura aplicada

El cuarto fichero se censuró de verdad: se marcaron las seis zonas y se aplicó la censura, que elimina el texto que queda debajo. De 403 caracteres pasó a 238, y lo que falta son exactamente los seis datos. Quedan los rótulos («Arrendataria:», «DNI:») y quedan la deuda y los meses, que no se tocaron.

Ese detalle importa. Censurar quita lo que marcas, nada más. Si el importe, las fechas o la referencia del contrato bastan para identificar a la persona, siguen ahí. Qué datos hay que quitar, además del nombre y los números, depende del documento y de quién lo vaya a leer.

Qué le llega a ChatGPT o a Claude cuando subes el fichero

La pregunta práctica es qué recibe el modelo cuando arrastras el PDF al chat. No hace falta suponerlo: OpenAI y Anthropic lo explican en sus propias páginas de ayuda, y lo que dicen coincide con la prueba.

ServicioQué toma del PDFFuente
ChatGPT, salvo EnterpriseEl texto digital; descarta las imágenesOpenAI, ayuda sobre subida de archivos
ChatGPT EnterpriseEl texto y también las imágenes y gráficosOpenAI, ayuda sobre recuperación visual
Claude (API)El texto de cada página y una imagen de cada páginaAnthropic, documentación de PDF

En ChatGPT, el texto digital

La ayuda de OpenAI sobre la subida de archivos dice que, en los planes distintos de Enterprise, ChatGPT extrae el texto digital del archivo y descarta las imágenes. El texto digital es precisamente la capa que sobrevive al rectángulo dibujado. El recuadro negro no llega; el nombre sí.

En ChatGPT Enterprise, la recuperación visual lee además las imágenes del PDF. Para un PDF tapado con rectángulos no cambia nada: el texto de debajo sigue llegando por su vía. Qué hace luego OpenAI con el archivo, y en qué plan entrena o no con ello, depende de ajustes que la guía de ChatGPT repasa uno a uno.

En Claude, el texto y la imagen de cada página

Anthropic explica en su documentación que, cuando se envía un PDF a Claude, el sistema convierte cada página en una imagen, extrae el texto de cada página y le da al modelo las dos cosas juntas. En una página con rectángulos dibujados, la imagen enseña el negro y el texto trae el nombre. El modelo tiene los dos.

La documentación citada es la de la API, que es la que describe el proceso con detalle. Para el uso diario de Claude y sus opciones de privacidad está la guía de Claude. La conclusión práctica: si el texto está en el fichero, cuenta con que el asistente lo lee.

Censurar en Acrobat Pro, paso a paso

La herramienta que hace el trabajo en Acrobat se llama Censurar, no Redactar, y Adobe advierte en su tutorial en español, actualizado el 3 de mayo de 2026, que solo está en Acrobat Pro, Premium y Studio. El Reader gratuito no la trae. Los pasos, con los nombres de los menús tal como los escribe Adobe:

  1. Abre la herramienta. En la barra, Todas las herramientas y, después, Censurar un PDF.
  2. Marca lo que quieres quitar. Censurar texto e imágenes, y arrastra el cursor sobre cada dato. Al pasar por encima ves una vista previa.
  3. Busca las repeticiones. Buscar texto y censurar encuentra una palabra, una frase o un patrón en todo el documento; marcas las casillas y eliges Marcar resultados comprobados para censura.
  4. Aplica. Aplicar, en el panel Censurar un PDF. Hasta ese momento solo había marcas.
  5. Quita lo oculto. Continuar, para eliminar también la información oculta. Adobe guarda el resultado en un archivo nuevo.
Cómo anonimizar un PDF en Acrobat Pro: el recorrido de la herramienta Censurar Cinco pasos en fila: Todas las herramientas, Censurar un PDF, Censurar texto e imágenes, Aplicar y Continuar. Solo a partir de Aplicar se elimina el texto. Todas las herramientas Censurar un PDF Censurar texto e imágenes Aplicar Continuar Hasta Aplicar, solo hay marcas: el texto sigue en el fichero
Los menús de Acrobat Pro en español. Adobe, tutorial «Quitar información confidencial», 3 de mayo de 2026

Marcar no es aplicar

El error más común con Acrobat Pro no es no tener la herramienta, sino dejarla a medias. Las marcas de censura, antes de aplicarse, solo señalan lo que se va a quitar: el texto sigue ahí. Si guardas en ese punto y subes el fichero, has subido el documento entero con unas marcas encima.

El paso de Continuar merece la misma atención. La información oculta de un PDF incluye cosas que no se ven en la página, como los comentarios o las capas ocultas. Los metadatos del fichero, con el autor o el programa que lo creó, son otro frente, que este paso también toca y que conviene revisar aparte.

Lo que Acrobat no decide por ti

Censurar es mecánico: quita lo que marcas. No sabe que la arrendataria de la primera página es la misma «Sra. Albiñana» del párrafo final, ni que el nombre del fichero lleva su apellido. Eso lo decide quien marca, y para eso sirve la búsqueda del paso 3, que conviene usar con cada dato aunque creas que solo aparece una vez. Pasa igual con los otorgantes de una escritura, que se repiten en cada cláusula.

La búsqueda de Acrobat admite, además de palabras sueltas, lo que Adobe llama motivos: tipos de información con una forma fija, útiles para números que cambian de un documento a otro. Aun así, revisa cada resultado antes de marcar su casilla, porque se borra lo que marcas, y lo que la búsqueda no encontró sigue en el fichero.

Sin Acrobat Pro: las salidas que sí quitan el texto

Muchas oficinas no tienen licencia de Acrobat Pro en cada puesto, y la tentación es buscar «censurar PDF gratis» y usar lo primero que sale. Antes de eso, conviene saber que hay salidas que no dependen de Acrobat Pro y que, para una consulta a una IA, funcionan mejor que censurar.

  1. Copiar el texto, limpiarlo y pegar solo eso. Si lo que quieres es una respuesta y no un fichero, no necesitas el PDF. Seleccionas el texto, lo pegas en un editor, quitas los datos y le pasas el resultado a la IA. Es lo más rápido, y no hay capa donde esconder nada.
  2. Pasar la página a imagen después de taparla. En la prueba, el fichero con rectángulos convertido en imagen dio 0 caracteres. Tiene coste: el PDF deja de poder buscarse, pesa más y, si la IA lee imágenes, sigue leyendo todo lo que no tapaste.
  3. Censurar con otro programa que aplique de verdad. Lo que cuenta no es la marca, sino que el programa elimine el contenido; se comprueba igual que con Acrobat, copiando y buscando.
0
caracteres de texto en el requerimiento tapado y pasado a imagen, frente a 403 sin pasar. Prueba propia, 28 de septiembre de 2026

Tapar el PDF en una web: qué mirar antes de subirlo

Hay muchas, y algunas trabajan bien. De cualquiera de ellas conviene saber tres cosas: qué se sube, si se guarda y quién lo ve. La herramienta de esta página tapa el documento, te devuelve el resultado y lo descarta en cuanto lo recibes. Y si el PDF lleva secreto profesional o datos de salud, para eso está la app de Nonimo, que hace el trabajo en tu propio equipo sin que el fichero se mueva de ahí.

Si en tu oficina hay reglas sobre qué herramientas se pueden usar, estas webs entran en la misma lista que los chats, y conviene escribirlo en las normas internas sobre inteligencia artificial.

Imprimir a PDF no es censurar

Una advertencia sobre un atajo que parece lógico: volver a guardar o imprimir el PDF tapado como un PDF nuevo no garantiza nada. Lo que decide es si el programa convierte la página en imagen o copia sus instrucciones al fichero nuevo, y no siempre lo dice. Si pruebas este camino, compruébalo con el copiar, pegar y buscar que se explica más abajo antes de fiarte. Exportar desde Word tampoco limpia: un cambio sin aceptar puede llegar al PDF.

El nombre que vuelve en la página cuatro

Tapar bien un dato no sirve si el mismo dato aparece en otro sitio del documento. Un escrito de diez páginas repite el nombre del cliente en el encabezado, en el cuerpo, en la firma y a veces en el pie de cada página. Quien tacha a ojo suele encontrar la primera aparición y se deja la cuarta. Un informe médico exportado a PDF puede llevar al paciente en la cabecera de cada hoja.

Por eso la búsqueda del documento entero es un paso obligatorio, no una comprobación opcional. Y hay que buscar con cabeza, porque el mismo dato se escribe de varias maneras en un solo PDF:

DatoVariantes que hay que buscar
NombreCon y sin tilde, en mayúsculas, solo el apellido, «Sra. Albiñana»
DNICon y sin puntos, con guion antes de la letra, solo los números
CuentaCon y sin espacios, solo los últimos dígitos
CorreoEl nombre de usuario, que suele llevar el apellido

Elaboración propia a partir del requerimiento de prueba.

Lo que no está en la página

El nombre del fichero viaja con el fichero. Un «requerimiento_Albiñana_sept.pdf» le dice a quien lo recibe de quién trata antes de abrirlo, y el chat lo recibe junto con el contenido. Renómbralo antes de subirlo; cuesta un segundo. Y si el PDF sale de una presentación, al exportarla decides si entran las diapositivas ocultas y los comentarios.

Si el PDF nació de un Word, el Word pudo arrastrar al PDF comentarios o texto que no esperabas, y lo sensato es limpiarlo en el Word antes de exportar.

Cómo anonimizar un PDF escaneado, que es una foto con texto invisible

Un PDF escaneado es otra cosa. No lleva instrucciones de texto, sino una imagen por página, como una fotografía de la hoja. En la prueba, el escaneado sin reconocimiento de texto dio 0 caracteres: no hay capa que extraer, y buscar el DNI no encuentra nada.

Eso no significa que la IA no lo lea. Anthropic dice que Claude recibe cada página como imagen, y OpenAI ofrece a ChatGPT Enterprise la lectura de las imágenes de un PDF. Un modelo que ve la página puede leer el nombre como lo lees tú. Lo que dijimos del rectángulo se invierte: en un escaneado, lo que importa es lo que se ve.

Cómo anonimizar un PDF escaneado: la imagen de la página y la capa invisible del reconocimiento de texto Un escaneado con OCR tiene dos capas: la imagen de la hoja, donde se pueden pintar recuadros negros, y debajo una capa de texto invisible que el escáner añadió. Pintar sobre la imagen no toca la capa invisible. Imagen de la hoja aquí se pinta el recuadro negro Capa de texto invisible (OCR) «DNI: 00000000T», intacto Una IA que mira la página ve el negro donde se pintó Una IA que extrae el texto lee el DNI de la capa invisible
Las dos capas de un escaneado con OCR. Esquema propio a partir de la prueba de esta guía

El escaneado con reconocimiento de texto

Muchos escáneres de oficina ofrecen guardar un PDF en el que se puede buscar, y para eso hacen reconocimiento de texto y añaden una capa invisible con las palabras encima de la imagen. Es cómodo, porque puedes buscar y copiar. Y es una trampa doble, porque ahora hay dos sitios donde está el dato.

En la prueba, el escaneado con esa capa y con rectángulos negros pintados sobre la imagen devolvió 402 caracteres, con el DNI dentro. Tapar la imagen no tocó la capa invisible. Hay que quitar el dato de los dos sitios. En Acrobat Pro la opción se llama, precisamente, Censurar texto e imágenes; úsala y comprueba después con la búsqueda.

Tapar en la imagen, y no encima de ella

Si el escaneado no tiene capa de texto, lo que hay que cambiar son los píxeles, como al tapar la foto del carnet de conducir. Un editor de imágenes que pinta sobre la imagen y la guarda aplanada deja el negro dentro de la foto; un editor de PDF que dibuja un rectángulo encima de la imagen deja la foto intacta debajo, como pasaba con el texto.

La foto de un DNI que llega por WhatsApp tiene el mismo problema, y nuestra guía para anonimizar el DNI explica qué hacer con ella. Con un escaneado, la comprobación es mirar el resultado con el zoom al máximo y, si hay capa de texto, buscar el dato. Y si la foto va tal cual a un chat, cuánto la guarda cada IA depende de la herramienta y del plan.

Copiar, pegar y buscar: la comprobación de treinta segundos

Ningún método de los anteriores se da por bueno hasta comprobarlo, y la comprobación está al alcance de cualquiera. Se hace sobre el fichero guardado, no sobre el que tienes abierto mientras trabajas, porque lo que sube a la IA es el guardado.

  1. Selecciona todo y copia. Ctrl+A y Ctrl+C en Windows, Cmd+A y Cmd+C en Mac, con el PDF abierto en cualquier lector.
  2. Pega en un bloc de notas. Lo que aparezca es, en esencia, lo que lee una herramienta que extrae texto. Si ves el nombre o el DNI, el tachado no ha funcionado.
  3. Busca cada dato. Ctrl+F o Cmd+F, con las variantes de la tabla anterior. En la prueba, el DNI salió una vez en los PDF con rectángulos y cero en el censurado.
  4. Ábrelo en otro lector. Un visor distinto puede enseñar lo que el tuyo oculta, sobre todo si hay comentarios o capas.
  1. ¿Aparece el nombre o el DNI al pegar el texto en un bloc de notas?

    SíEl tachado no ha funcionado: vuelve a censurar o limpia el texto fuera del PDF.

    NoSigue con la búsqueda de cada dato y sus variantes.

  2. ¿La búsqueda encuentra alguna variante?

    SíQueda una aparición sin tapar: márcala y aplica otra vez.

    NoMira si el documento es un escaneado.

  3. ¿Es un escaneado?

    SíCopiar y buscar no ven la imagen: revisa la página a la vista.

    NoLa capa de texto está limpia de esos datos.

Todo se hace sobre el fichero guardado, que es el que sube.

La comprobación, paso a paso. Elaboración propia

Lo que esta prueba no ve

Copiar y pegar enseña la capa de texto, y buscar encuentra lo que está escrito como texto. Ninguna de las dos lee una imagen. En un escaneado sin capa, las dos darán cero aunque el nombre esté a la vista, y la comprobación buena es mirar la página.

Tampoco te dicen si lo que queda identifica a alguien sin su nombre. Para eso no hay atajo: leer el documento como lo leería un extraño que conoce el caso. Y si la comprobación falla con un PDF que ya estaba subido, lo que toca es actuar como ante una brecha.

Lo que dice el RGPD de un tachado que no tacha

El reglamento no habla de rectángulos, pero sí de lo que hay debajo. Tres artículos bastan para ver por qué un tachado que se deshace con copiar y pegar es un problema jurídico y no solo técnico:

Artículo del RGPDQué pideCon un tachado que no tacha
5.1.c), minimizaciónSolo los datos necesarios para la finalidadPara preguntar por un plazo, sobran el nombre y el DNI
32, seguridadMedidas apropiadas al riesgoUn negro que se copia no protege nada
28, encargadoContrato con quien trata por tu cuentaEl proveedor de la IA recibe el dato

Reglamento (UE) 2016/679, en el BOE.

Si el dato no llega, no hace falta discutir si el contrato con el proveedor cubre ese uso; si llega, la discusión es tuya. Qué proveedor ofrece ese contrato, y en qué plan, lo compara nuestra guía de las cuentas de empresa.

Anonimizar, en sentido estricto

La palabra que se busca es «anonimizar», y conviene usarla con cuidado. El considerando 26 del RGPD llama anónimos a los datos con los que ya no se puede identificar a nadie por medios razonables. La AEPD y el Supervisor Europeo, en su documento sobre diez malentendidos de la anonimización, recuerdan que quitar el nombre no basta si otros datos permiten llegar a la persona.

Un PDF censurado para una consulta suele seguir hablando de alguien concreto, y la oficina que lo censuró sabe de quién. Eso es seudonimizar: el dato sigue siendo personal para ti, aunque la IA no vea el nombre. Por qué esa diferencia tiene consecuencias lo cuenta nuestra guía sobre seudonimizar datos.

La limpieza de documentos en el sector público

En las administraciones y en sus proveedores, el Esquema Nacional de Seguridad tiene una medida con nombre propio. El Real Decreto 311/2022 incluye la limpieza de documentos, que obliga a retirar la información adicional de campos ocultos, metadatos, comentarios y revisiones anteriores, y la aplica en todos los niveles. Si el documento es un .odt, esa limpieza se hace en LibreOffice, y limpiar un .odt de Writer empieza por aceptar los cambios y borrar los comentarios.

No está escrita pensando en la IA, sino en publicar documentos. Pero describe bien el problema: lo que el documento lleva sin que se vea. Si trabajas con un ayuntamiento, esa medida puede obligarte ya, subas o no el PDF a un chat.

Un PDF tachado, pasado por Nonimo: antes y después

Nonimo trabaja con el texto, que es justo donde falla el recuadro negro. En la app, sueltas un documento en su ventana y te enseña el texto con los datos tapados: desde ahí lo copias para pegarlo en la IA o descargas una copia tapada. Un PDF vuelve como un PDF nuevo que solo lleva el texto, sin el diseño ni los metadatos del original. Si pegas texto, lo seleccionas y pulsas la tecla.

Este es el texto extraído del requerimiento con los rectángulos dibujados, pasado por el motor de Nonimo el 28 de septiembre de 2026:

ANTES (el texto del PDF con recuadros negros)
REQUERIMIENTO DE PAGO
Valencia, 14 de septiembre de 2026
Arrendataria: Nerea Albiñana Coloma
DNI: 00000000T
Domicilio: calle del Pintor Sorolla Inventada 17, 3.º B, 46010 Valencia
Teléfono: 000 00 00 00 · Correo: nerea.albinana@example.com
Adeuda 2.340,00 euros de las rentas de junio, julio y agosto de 2026.
Puede abonarlos en la cuenta ES82 0000 0000 0000 0000 0000 en un plazo de diez días.

DESPUÉS (Nonimo)
REQUERIMIENTO DE PAGO
Valencia, 14 de septiembre de 2026
Arrendataria: [PERSONA_1]
DNI: [DNI_1]
Domicilio: [DATO_FICHA_1]
Teléfono: [TELEFONO_1] · Correo: [CORREO_1]
Adeuda 2.340,00 euros de las rentas de junio, julio y agosto de 2026.
Puede abonarlos en la cuenta [IBAN_1] en un plazo de diez días.

Todo es inventado: el DNI y la cuenta no son de nadie, y la calle no existe.

Cuando llega la respuesta, la app pone otra vez el nombre, el DNI y la cuenta donde estaban las marcas, y solo lo ves tú. Es seudonimizar, no anonimizar.

La app lee también un PDF escaneado, en Mac y en Windows: reconoce el texto de sus páginas en tu ordenador, hasta cincuenta, y te lo devuelve tapado. Qué guarda la app en el disco y qué envía, un recuento diario sin texto, lo detalla nuestra página de seguridad; el precio, la de la licencia.

Fuentes

Nonimo es el software que hace esto en tu propio ordenador: tapa nombres, DNI y expedientes antes de que el texto llegue a ChatGPT. Sin cuenta, y la app lo hace sin que los datos de tus clientes salgan de tu equipo.

Preguntas frecuentes

¿Cómo anonimizar un PDF para subirlo a ChatGPT?

Borrando el texto, no tapándolo. Un recuadro negro dibujado encima deja el dato en la capa de texto, y ChatGPT, según la ayuda de OpenAI, trabaja con el texto digital del archivo. Sirve la herramienta Censurar de Acrobat Pro, que elimina lo marcado al aplicar, o copiar el texto, limpiarlo y pegar solo eso. Nonimo hace lo segundo y cambia nombre, DNI, IBAN o teléfono por marcas antes de pegar: la app, en tu propio equipo; la herramienta de esta página, que te devuelve el texto tapado y descarta el documento en cuanto lo recibes.

¿Por qué se puede copiar el texto que está debajo del recuadro negro?

Porque en un PDF el texto y los dibujos son objetos distintos, y el rectángulo es un dibujo más que se pinta encima. La pantalla enseña el negro, pero los caracteres siguen en el fichero. En nuestra prueba, un requerimiento con seis datos tapados devolvió los mismos 403 caracteres que el original. Por eso Nonimo trabaja con el texto que sale del documento, que es lo que recibe la IA, y no con lo que se ve.

¿Sirve Acrobat Reader gratis para censurar un PDF?

No para censurar. Adobe indica que la herramienta Censurar solo está disponible en Acrobat Pro, Premium y Studio. Con el Reader gratuito puedes dibujar un rectángulo o añadir un comentario, y los dos dejan el texto intacto debajo. Si no tienes Pro, lo más seguro para una consulta es copiar el texto y limpiarlo fuera del PDF, que es donde actúa Nonimo: sobre las letras, no sobre los recuadros.

¿Cómo compruebo que un PDF ya no esconde texto?

Abre el fichero guardado, selecciona todo, copia y pega en un bloc de notas: si aparece el nombre o el DNI, el tachado no ha funcionado. Luego busca con Ctrl+F cada dato y sus variantes, sin tildes o con puntos. En nuestra prueba, el DNI salió una vez en el PDF con recuadros y cero en el censurado. Con Nonimo puedes pasar ese mismo texto pegado y ver qué marcas pone.

¿Lee una IA el texto de un PDF escaneado?

Puede leerlo aunque no haya capa de texto. Anthropic explica que Claude convierte cada página del PDF en imagen y la analiza junto al texto, y OpenAI ofrece en ChatGPT Enterprise la lectura de imágenes dentro de los PDF. Si el escáner hizo OCR, además hay una capa de texto invisible. La app de Nonimo lee también un PDF escaneado, en Mac y en Windows, en tu ordenador.

¿Es buena idea censurar el PDF en una web?

Sí, siempre que sepas qué recibe, si lo conserva y quién puede verlo. Con la herramienta que tienes en esta página, el PDF se tapa y lo descartamos en cuanto te devolvemos el resultado. Para un documento sensible, como un expediente con secreto profesional o un informe de salud, usa la app de Nonimo: lo tapa en tu ordenador y el fichero no sale de él.

¿Tachar un PDF es anonimizarlo a efectos del RGPD?

Casi nunca. El considerando 26 del RGPD reserva la palabra anónimo para datos con los que ya no se puede identificar a nadie por medios razonables, y un PDF sin nombre suele seguir hablando de una persona concreta por su contexto. Lo normal es que sea una seudonimización, y el dato sigue siendo personal para ti. Nonimo también seudonimiza: cambia identificadores por marcas, y tú sigues sabiendo a quién corresponde cada una.

¿Qué devuelve Nonimo si le das un PDF tachado?

El texto del documento con los datos cambiados por marcas, listo para pegar, y, si la quieres, una copia tapada para descargar: un PDF nuevo que solo lleva el texto, sin el diseño ni los metadatos del original. Como parte del texto, y no de lo que se ve, le da igual que haya recuadros negros encima. Si el PDF es escaneado, la app lee sus páginas en tu ordenador, en Mac y en Windows, y te da el texto tapado.