LocalUtils field note · Marcar e rasterizar áreas sensíveis em um PDF
Marcar e rasterizar áreas sensíveis em um PDF
Desenhar um retângulo preto sobre o texto não é necessariamente uma ocultação. Em muitos editores de PDF, o texto original permanece sob o retângulo e ainda pode ser copiado, pesquisado ou extraído.
Esta ferramenta adota uma abordagem destrutiva para páginas que contêm marcas: ela renderiza a página como uma imagem, queima as áreas pretas nesses pixels e coloca a imagem achatada em uma nova página PDF. As páginas não marcadas são copiadas em vez de rasterizadas.
Início rápido
- Adicione um PDF e aguarde a renderização das visualizações da página.
- Abra cada página que contenha material sensível e desenhe caixas um pouco além de toda a área que deve desaparecer.
- Revise cada página com zoom útil, incluindo cabeçalhos, rodapés, identificadores repetidos, anexos, comentários e páginas sem marcas.
- Exporte o PDF reconstruído, reabra-o em outro visualizador, procure o texto removido e inspecione as propriedades do documento antes de compartilhar.
device → browser engine → result
O que o navegador faz
PDF.js renderiza páginas marcadas em aproximadamente 2,5 vezes a escala da página. Os retângulos de ocultação são pintados na tela. PDF-lib então cria uma nova página contendo essa imagem raster.
A rasterização remove o texto original selecionável e o conteúdo vetorial da página marcada da página exportada, mas também altera a qualidade, a acessibilidade, a capacidade de pesquisa, os formulários, os links e o tamanho do arquivo. As páginas não marcadas mantêm seus fluxos de conteúdo PDF originais.
Entradas e saídas
- Entrada: um PDF que o PDF.js pode renderizar.
- Marcas: regiões retangulares desenhadas nas visualizações de páginas.
- Saída: um PDF com páginas marcadas rasterizadas e páginas não marcadas copiadas.
Limites a saber antes de começar
- A ferramenta não consegue saber se todas as áreas sensíveis foram marcadas.
- As páginas não marcadas são copiadas, portanto, seu texto original, metadados, anotações e anexos exigem revisão separada.
- As páginas rasterizadas perdem o texto selecionável e podem ficar menos acessíveis.
- Uma caixa preta visual pode ocultar muito pouco se a marca não cobrir todo o glifo ou contexto circundante.
Solução de problemas
- Se o texto aparecer fora de uma caixa, amplie a marca e exporte novamente.
- Se uma página parecer suave, compare a saída com zoom de leitura normal; a rasterização troca a editabilidade pelo achatamento destrutivo.
- Se o PDF contiver formulários, assinaturas, camadas ou anexos, use um fluxo de trabalho de segurança de PDF dedicado e inspecione esses objetos separadamente.
Lista de verificação de verificação
- Pesquise no PDF exportado cada nome, número e frase removidos.
- Tente selecionar ou copiar o texto de cada página rasterizada.
- Inspecione metadados, anexos, comentários e páginas não marcadas de forma independente; marcas de ocultação não as limpam.
Perguntas que as pessoas fazem
A ferramenta pode encontrar texto confidencial automaticamente?
Não. O usuário escolhe cada retângulo. A detecção e a suficiência legal continuam sendo de responsabilidade do usuário.
O resultado é adequado para todas as divulgações legais?
Nenhuma reivindicação universal é possível. Os requisitos variam e documentos complexos podem precisar de revisão especializada ou software de ocultação aprovado.
Por que apenas as páginas marcadas são achatadas?
A cópia de páginas não marcadas preserva sua qualidade e recursos, enquanto as páginas marcadas são reconstruídas para remover o conteúdo de origem coberto.
