¿Es Suficiente el "Tachado" en un PDF? Detrás de la Redacción Real
6 min de lectura
El recuadro negro, en realidad no elimina nada
Dibujar un rectángulo negro para "ocultar" un número de identificación, un IBAN o el nombre de un cliente en un PDF es, por lo que hemos visto, una de las falacias de seguridad más comunes del mundo. Visualmente el texto parece desaparecer, pero la lógica de funcionamiento del formato PDF desmiente esto: un PDF es en realidad un documento compuesto por capas superpuestas. Mientras que en la capa inferior permanecen los objetos de texto reales, los códigos de carácter y los mapas de fuente, el recuadro negro dibujado encima es solo una nueva capa visual — como una calcomanía pintada sobre el texto.
El resultado de esto se ha visto muchas veces en la práctica: cuando alguien abre ese PDF "oculto" y selecciona y copia el texto, o examina el archivo en un editor de texto/analizador de PDF, el contenido original que está debajo del recuadro aparece tal cual. A veces basta algo aún más simple — arrastrar o eliminar el recuadro con el ratón. La causa raíz de una parte de las filtraciones corporativas, las filtraciones de documentos judiciales y los escándalos periodísticos es exactamente esta: documentos que se creía que estaban "redactados" pero que en realidad solo estaban enmascarados visualmente.
Cómo resuelve este problema la herramienta Redacción de PDF
La herramienta de Redacción de PDF de nuestra plataforma funciona con un enfoque que rechaza de raíz esta falacia del recuadro visual: rasterizado-aplanado (rasterize-flatten). El método sigue, en esencia, estos pasos:
- El usuario marca en la página el área a ocultar (texto, firma, celda de tabla, región visual — lo que sea).
- La página marcada se extrae de su estructura vectorial/basada en texto y se convierte en una imagen basada en píxeles (rasterizado). En este punto, todos los objetos de texto, referencias de fuente y datos de carácter de la página dejan de existir — solo queda una "imagen".
- La región marcada se rellena de forma permanente sobre esta imagen (aplanado/flatten) y la página se vuelve a empaquetar en el PDF.
Resultado: en esa página ya no queda ningún objeto de texto "oculto" que se pueda seleccionar, copiar o extraer con un analizador. Porque ya no queda nada que sea un objeto de texto — la página se ha convertido por completo en una imagen. Esto no es un ocultamiento cosmético, sino la extracción física de los datos de la estructura del archivo.
Por qué rasterizamos la página y no "solo esa área"
Algunas herramientas intentan "eliminar" únicamente el texto que está debajo del recuadro marcado, pero esta es una operación extremadamente frágil dentro de la estructura de objetos anidados del PDF — existe un alto riesgo de dejar restos en flujos de texto superpuestos, capas ocultas (OCG), campos de formulario o metadatos. Convertir la página completa en imagen y aplicar un relleno permanente sobre ella es el método que técnicamente previene este riesgo de la forma más definitiva. Por supuesto, tiene un costo: la página ya no se puede seleccionar como texto, deja de ser buscable. Pero ese es precisamente el propósito de la redacción — un ocultamiento sin retorno. Nuestra herramienta muestra este cambio con claridad al usuario; no dejamos ambigua la diferencia entre "ocultado" y "eliminado".
Cuándo se necesita
La redacción es una de las herramientas de PDF que más se usa erróneamente con fines "estéticos". La necesidad real generalmente surge en estos escenarios:
- Solicitudes de acceso a la información / difusión de documentos públicos: un organismo debe ocultar la información de identidad, las firmas o las cifras de carácter comercial confidencial de terceros antes de compartirlas.
- Difusión de documentos legales: al compartir un contrato o un expediente judicial con la otra parte o con el público, deben eliminarse los detalles financieros o los datos personales del cliente.
- Recursos humanos y bases de currículums: al compartir datos de candidatos para su análisis, puede ser necesario eliminar de forma permanente campos como el número de identificación o la fecha de nacimiento.
- Documentos de salud y seguros: la información de identidad del paciente y los números de póliza deben eliminarse realmente del documento antes de compartirlo — no solo visualmente.
- Uso periodístico y de investigación: en documentos que requieren protección de fuentes, hay que asegurarse de que detalles identificativos como nombre, teléfono o correo electrónico se eliminen por completo del archivo.
El punto en común de estos escenarios es este: el documento se comparte bajo la suposición de que la información oculta nunca podrá recuperarse de ninguna manera. El recuadro visual no cumple esta suposición; el rasterizado-aplanado sí.
Su significado en términos de privacidad y seguridad
La fiabilidad de una herramienta de redacción se puede reducir en realidad a una sola pregunta: "¿Alguien que examine este documento a nivel de datos crudos puede acceder a la información oculta?" En los métodos que solo usan el recuadro visual, la respuesta suele ser sí — la capa de texto, los restos de metadatos o las capas de "deshacer" pueden seguir estando ahí. En el enfoque de rasterizado-aplanado, como la página ya no es más que una imagen, técnicamente se puede responder que no a esta pregunta.
Además de esto, el propio proceso de procesamiento también es importante: en nuestra plataforma los archivos no se conservan de forma permanente en el servidor, se eliminan automáticamente en un breve período después del procesamiento. Es decir, que los datos "ocultados" durante la redacción no dejen rastro en ningún otro lugar después de finalizar el proceso también forma parte de la arquitectura. La promesa de privacidad de una herramienta de redacción debe medirse no solo por el archivo de salida, sino también por la forma en que se procesa ese archivo — nosotros abordamos ambas cosas juntas.
Una última advertencia: aunque el rasterizado-aplanado es un método potente, no es una varita mágica. No compartir una versión anterior sin redactar del mismo documento, no dejar información sensible en los nombres de archivo/metadatos y marcar correctamente las áreas a ocultar siguen siendo responsabilidad del usuario. La herramienta garantiza que el contenido correctamente marcado se elimine de forma irrecuperable; decidir qué contenido debe ocultarse corresponde al usuario.
Preguntas frecuentes
¿Puedo volver a seleccionar y copiar el texto que redacté en el PDF?
No. Después de la operación de rasterizado-aplanado, esa página se convierte por completo en una imagen, por lo que no queda texto seleccionable en la región oculta — ya no existe como objeto de texto.
¿La redacción puede ocultar solo texto, o también imágenes?
Puede usarse tanto para ocultar texto como elementos visuales como firmas, fotos o celdas de tabla. El método funciona independientemente del tipo de región seleccionada, porque el área marcada se procesa a nivel de píxel.
¿Los demás textos de la página siguen siendo buscables después de la redacción?
Sí, solo se rasterizan las páginas/regiones que marcas; en las páginas donde no se aplica redacción, la capa de texto y la función de búsqueda se conservan tal cual.
Pruébalo ahora mismo con PDF Redaksiyon.
Probar PDF Redaksiyon