LocalUtils field note · Marcar y rasterizar áreas sensibles en un PDF
Marcar y rasterizar áreas sensibles en un PDF
Dibujar un rectángulo negro sobre el texto no es necesariamente censura. En muchos editores de PDF, el texto original permanece debajo del rectángulo y aún se puede copiar, buscar o extraer.
Esta herramienta adopta un enfoque destructivo para las páginas que contienen marcas: representa la página como una imagen, graba las áreas negras en esos píxeles y coloca la imagen aplanada en una página PDF nueva. Las páginas sin marcar se copian en lugar de rasterizarse.
Inicio rápido
- Agregue un PDF y espere a que se procesen las vistas previas de la página.
- Abra cada página que contenga material confidencial y dibuje cuadros un poco más allá del área completa que debe desaparecer.
- Revise cada página con un zoom útil, incluidos encabezados, pies de página, identificadores repetidos, archivos adjuntos, comentarios y páginas sin marcas.
- Exporte el PDF reconstruido, vuelva a abrirlo en otro visor, busque el texto eliminado e inspeccione las propiedades del documento antes de compartirlo.
device → browser engine → result
Qué hace el navegador
PDF.js representa páginas marcadas a aproximadamente 2,5 veces la escala de la página. Los rectángulos de censura están pintados en el lienzo. Luego, PDF-lib crea una página nueva que contiene esa imagen rasterizada.
La rasterización elimina el texto seleccionable original y el contenido vectorial de la página marcada de la página exportada, pero también cambia la calidad, la accesibilidad, la capacidad de búsqueda, los formularios, los enlaces y el tamaño del archivo. Las páginas sin marcar conservan sus flujos de contenido PDF originales.
Entradas y salidas
- Entrada: un PDF que PDF.js puede representar.
- Marcas: regiones rectangulares dibujadas en vistas previas de páginas.
- Salida: un PDF con páginas marcadas rasterizadas y páginas copiadas sin marcar.
Límites que debes conocer antes de empezar
- La herramienta no puede saber si se marcaron todas las áreas sensibles.
- Las páginas no marcadas se copian, por lo que su texto original, metadatos, anotaciones y archivos adjuntos requieren una revisión por separado.
- Las páginas rasterizadas pierden texto seleccionable y pueden ser menos accesibles.
- Un cuadro negro visual puede ocultar muy poco si la marca no cubre el glifo completo o el contexto circundante.
Solución de problemas
- Si aparece texto fuera de un cuadro, amplíe la marca y exporte nuevamente.
- Si una página parece suave, compare el resultado con el zoom de lectura normal; la rasterización cambia la editabilidad por el aplanamiento destructivo.
- Si el PDF contiene formularios, firmas, capas o archivos adjuntos, utilice un flujo de trabajo de seguridad de PDF dedicado e inspeccione esos objetos por separado.
Lista de verificación de verificación
- Busque en el PDF exportado cada nombre, número y frase eliminados.
- Intente seleccionar o copiar texto de cada página rasterizada.
- Inspeccionar metadatos, archivos adjuntos, comentarios y páginas sin marcar de forma independiente; las marcas de censura no las limpian.
Preguntas que hace la gente
¿Puede la herramienta encontrar texto confidencial automáticamente?
No. El usuario elige cada rectángulo. La detección y suficiencia legal son responsabilidad del usuario.
¿El resultado es adecuado para cada divulgación legal?
Ninguna afirmación universal es posible. Los requisitos varían y los documentos complejos pueden necesitar una revisión especializada o un software de censura aprobado.
¿Por qué sólo se aplanan las páginas marcadas?
Copiar páginas no marcadas conserva su calidad y características, mientras que las páginas marcadas se reconstruyen para eliminar el contenido original cubierto.
