Guia de Mesclagem e Divisão de PDF: Princípios e Descrição de Regras para Operações a Nível de Página
Este artigo explica as regras de operação da ferramenta de mesclagem e divisão de PDF do OKfmt, analisa o princípio central da cópia a nível de página e descreve a sintaxe de seleção de intervalo de páginas e o limite de 200 páginas por tarefa única.
Atualizado 2026-08-11
Princípio Central: Diferença entre Cópia a Nível de Página e Re-renderização
A ferramenta de mesclagem e divisão de PDF do OKfmt utiliza um mecanismo de cópia a nível de página, que copia diretamente os objetos de página do PDF original para gerar um novo arquivo. Este mecanismo retém completamente a camada de texto e as informações de gráficos vetoriais das páginas originais, e não realiza conversão de formato no conteúdo original.
A re-renderização converte as páginas originais do PDF para imagens bitmap e depois regenera um novo PDF. Este processo perde contornos vetoriais e camadas de texto editáveis. A cópia a nível de página apenas reconstrói a estrutura do documento sem modificar o conteúdo de páginas individuais, por isso o seu efeito de retenção para PDFs baseados em texto atende aos requisitos da maioria dos casos de uso.
| Dimensão de Comparação | Cópia a Nível de Página | Re-renderização |
|---|---|---|
| Retenção da camada de texto | Retém completamente o texto editável original | Perde a editabilidade após conversão para bitmap |
| Retenção de gráficos vetoriais | Retém completamente os contornos vetoriais originais | Perde as informações vetoriais após conversão para bitmap |
| Tamanho do arquivo de saída | Próximo da soma dos tamanhos das páginas individuais originais | Depende da configuração de resolução utilizada para a re-renderização |
Regras de Operação de Mesclagem e Descrição da Ordem de Páginas
O limite máximo total de páginas para uma tarefa de mesclagem única é de 200 páginas. Se o número total de páginas de todos os arquivos carregados numa única tentativa exceder este valor, o processamento irá falhar, sendo necessário dividir a tarefa em vários lotes para processamento.
A ordem das páginas do novo PDF mesclado segue a ordem dos arquivos carregados, e as páginas dentro do mesmo arquivo mantêm a sua ordem original. Pode ajustar a ordem de arranjo dos arquivos após o carregamento para personalizar a ordem final das páginas de saída.
- A versão atual não suporta a migração de marcadores ou campos de formulário do PDF original. Estas funcionalidades ainda não estão disponíveis
- PDF criptografado requer a senha de abertura correta para concluir a mesclagem. A ativação do parâmetro de ignorar criptografia não contorna a verificação da senha de abertura
Regras de Sintaxe de Seleção de Intervalo de Páginas para Extração por Divisão
É necessário introduzir o intervalo de páginas a extrair na caixa de entrada. A ferramenta suporta entrada mista de intervalos contínuos e números de página individuais. A numeração de páginas começa em 1, o que corresponde aos números de página exibidos no PDF.
Números de página contínuos utilizam um hífen para ligar as páginas inicial e final, no formato "inicial-final". Por exemplo, 1-5 significa extrair todas as páginas da página 1 à página 5. Números de página individuais são separados por vírgulas de meia largura, não são necessários espaços adicionais.
Um exemplo de formato misto é "1,3,5-7". Este intervalo indica a extração da página 1, página 3 e páginas 5 a 7, totalizando 6 páginas. A ordem final das páginas de saída segue a ordem introduzida no intervalo.
Diferenças de Processamento para Diferentes Tipos de PDF
PDF baseado em texto refere-se a PDF que contém uma camada de texto editável. O mecanismo de cópia a nível de página retém completamente a capacidade de cópia do texto e as informações vetoriais, e o arquivo de saída suporta pesquisa de texto normal.
PDF digitalizado é essencialmente composto por imagens de página e não possui uma camada de texto editável. Para PDF digitalizado, a cópia a nível de página e a re-renderização produzem resultados idênticos, ambos retêm completamente a qualidade de imagem original na saída.
Para PDF criptografado, apenas as restrições de permissão do proprietário podem ser contornadas. A ativação do parâmetro de ignorar criptografia permite extrair páginas de PDF criptografado, mas não contorna a verificação da senha de abertura. É necessário introduzir a senha correta para processar o arquivo.
Perguntas frequentes
Por que os marcadores do PDF original desapareceram após a mesclagem?
A versão atual do OKfmt não suporta a migração de marcadores do PDF original. A ferramenta apenas realiza operações de cópia a nível de página e ainda não implementou a migração de informações de estrutura do documento. Esta funcionalidade será avaliada para adição em versões futuras.
PDF criptografado pode ser processado diretamente?
A avaliação depende do tipo de permissão. Para PDF criptografado que apenas restringe impressão e edição, pode processá-lo ativando a opção de ignorar criptografia. Para PDF criptografado que requer uma senha de abertura, é necessário introduzir a senha correta para processá-lo.
Arquivos com mais de 200 páginas podem ser processados?
O OKfmt tem um limite de 200 páginas por tarefa única, e envios que excedam o limite não podem ser processados. Pode dividir o arquivo em várias tarefas para processamento separado, depois mesclar os vários arquivos de saída para obter o arquivo completo.