FileCarpenter
Por que alguns textos em PDF podem ser editados e outros não
PDF é um formato de descrição de páginas, não um documento do Word. Duas páginas visualmente iguais podem armazenar texto de maneiras completamente diferentes; por isso uma edição confiável começa pela estrutura dos objetos da página.
Um PDF não contém “parágrafos” por padrão
Em geral, a página PDF descreve onde cada glifo é desenhado. Alguns programas preservam informações suficientes de fonte, caracteres e espaçamento; outros dividem palavras em muitos operadores pequenos ou reutilizam códigos de glifos de maneiras incomuns.
Quando a substituição estrutural de texto é possível
Texto selecionável com um mapeamento de fonte utilizável muitas vezes pode ser alterado estruturalmente. O FileCarpenter verifica o trecho, a fonte, o espaçamento e os objetos ao redor. Se a estrutura for ambígua demais, é mais seguro recusar a alteração ou usar um fluxo de compatibilidade do que danificar a página silenciosamente.
Digitalizações e letras convertidas em contornos são diferentes
Uma página digitalizada pode conter apenas pixels; uma camada OCR invisível pode permitir seleção sem corresponder exatamente à imagem visível. Alguns PDFs de design convertem letras em contornos vetoriais, que são formas e não texto comum.
O que verificar depois da edição
Compare quebras de linha, fontes, espaçamento, recortes, marcações estruturais e gráficos próximos. Em documentos importantes, guarde o original e reabra o PDF exportado no visualizador ou sistema onde ele será realmente usado.