Guía práctica · RGPD

Cómo anonimizar un PDF paso a paso (2026)

7 min de lecturaPor Ana Gloria Gómez Ruiz
Respuesta rápida

Cómo anonimizar un PDF de verdad: por qué tachar en negro no basta, qué revisar a mano y cuándo conviene automatizarlo. Guía práctica.

Si buscas cómo anonimizar un PDF, lo más probable es que necesites publicar, enviar o archivar un documento sin que aparezcan datos personales. La forma de hacerlo bien depende del volumen: un documento suelto se puede revisar a mano con cuidado; una notificación, un expediente o un boletín que se repite cada semana necesita un proceso que no dependa de que alguien no se olvide de un campo.

¿Por qué tachar en negro no es anonimizar?

El error más común —y el que más sanciones ha generado, como recogemos en nuestro análisis de casos reales de la AEPD— es cubrir el dato con una forma de color en el propio editor de PDF o en Word antes de exportar. El problema es que, en la mayoría de herramientas, esa forma se coloca encima del texto, no en lugar del texto: el contenido original sigue existiendo en la capa de texto del archivo y puede recuperarse copiando el contenido, extrayéndolo con un script sencillo o, en algunos casos, simplemente moviendo el objeto que lo tapa.

Anonimizar un PDF correctamente significa eliminar el dato de la capa de texto, no ocultarlo visualmente. Si quieres el marco conceptual completo, lo explicamos en qué es la anonimización de documentos.

¿Cómo anonimizar un PDF a mano, paso a paso?

  1. Identifica todos los datos personales del documento, no solo el nombre: DNI, dirección, teléfono, IBAN, matrícula, firma, fecha de nacimiento y cualquier dato que combinado permita identificar a alguien.
  2. Usa la función de redacción real del editor (en Adobe Acrobat Pro, por ejemplo, se llama "Redactar", no "Resaltar" ni "Dibujar forma"), que elimina el texto subyacente además de taparlo visualmente. Las herramientas de dibujo o resaltado no sirven para esto.
  3. Aplica la redacción y guarda una copia nueva del archivo: en la mayoría de programas el proceso no es definitivo hasta que se "aplican" los cambios y se exporta.
  4. Revisa los metadatos del archivo (autor, empresa, comentarios, historial de revisiones, coordenadas GPS de las imágenes) y elimínalos. Lo explicamos en cómo eliminar los metadatos de un PDF.
  5. Comprueba el resultado intentando seleccionar y copiar el texto de las zonas redactadas. Si puedes copiar algo del dato original, el proceso ha fallado.
  6. Repite la comprobación tras cualquier conversión de formato (Word a PDF, escaneo con OCR, combinación de varios PDF). Cada conversión puede reintroducir datos que ya habías eliminado.

¿Cuándo deja de ser viable el proceso manual?

El proceso anterior funciona para un documento aislado, pero se vuelve poco fiable en cuanto entra en juego el volumen: notificaciones periódicas, expedientes administrativos, resoluciones que se publican cada semana, historiales clínicos o escritos judiciales. Ahí aparecen tres problemas recurrentes:

  • Inconsistencia entre personas: quien revisa el documento el lunes no aplica el mismo criterio que quien lo revisa el viernes.
  • Formatos mixtos: PDF, Word, Excel, CSV, imágenes escaneadas… cada formato esconde el dato en un sitio distinto.
  • Falta de rastro: nadie puede demostrar después qué se detectó y qué se eliminó en cada documento.

¿Qué mirar si decides automatizarlo?

  • Que elimine el dato de la capa de texto, no que lo tape visualmente (el mismo problema que en la redacción manual, pero a escala).
  • Cobertura de formatos: PDF, Word, Excel, CSV, JSON e imágenes escaneadas con OCR, sin exportar y reprocesar a mano.
  • Dónde se procesa el documento: para sector público, que el tratamiento se realice en un entorno controlado y auditable, algo relevante para el Esquema Nacional de Seguridad — lo desarrollamos en anonimización en la Administración Pública.
  • Registro de lo detectado y eliminado, para poder justificar el tratamiento ante una auditoría o una inspección.
  • Consistencia: el mismo criterio aplicado a cien documentos que a uno solo.

Anonimizia está orientado precisamente a ese escenario: detección automática sobre documentos y lotes, revisión humana antes de exportar y registro del proceso. Puedes solicitar una prueba.

Preguntas frecuentes

¿Sirve con exportar el Word a PDF después de borrar los datos en Word?

Solo si de verdad borraste el texto (no lo tapaste con un resaltado o un cuadro de color) y además limpiaste los metadatos y el historial de cambios del Word original, que puede seguir conteniendo el dato aunque ya no se vea.

¿El OCR puede reintroducir datos que ya había eliminado?

Sí. Si escaneas un documento en el que tapaste un dato visualmente pero el texto seguía debajo, el OCR puede volver a capturarlo como texto reconocible. Por eso conviene comprobar el resultado final, no solo el paso intermedio.

¿Anonimizar un PDF afecta a la firma electrónica?

Sí puede afectar: modificar un documento firmado electrónicamente invalida la firma. Si el original está firmado y debe seguir estándolo, hay que anonimizar antes de firmar, o generar y firmar una versión anonimizada como documento nuevo.

Fuentes y referencias

Fuentes oficiales

Fuentes y referencias

Todo lo que se explica aquí se apoya en normativa publicada y en las orientaciones de la Agencia Española de Protección de Datos. Estos son los textos originales:

¿Anonimizas documentos a diario?

Deja de tachar a mano. Automatízalo con anonimizia.

Sube tus PDFs y obtén documentos anonimizados conforme al RGPD en segundos.

Probar gratis