Separar PDF — Extrair Páginas

Extraia páginas ou intervalos selecionados de um PDF para um arquivo novo — tudo no seu navegador, nada é enviado.

1.254 visualizações

Como Funciona

Separar um PDF significa extrair objetos de página específicos da estrutura interna do documento de origem e escrevê-los em um arquivo PDF totalmente novo, usando a biblioteca de código aberto pdf-lib, executada inteiramente no seu navegador. Cada página mantém seu próprio fluxo de conteúdo e quaisquer recursos que referencia — fontes, imagens, gráficos vetoriais — copiados fielmente, de modo que o texto continua selecionável e as imagens mantêm exatamente a compressão original que tinham no arquivo de origem.

Há um detalhe sutil que vale a pena conhecer: um PDF de várias páginas costuma compartilhar recursos entre as páginas — o exemplo mais claro é uma fonte incorporada usada no corpo do texto ao longo de todo o documento, que o arquivo original armazena uma única vez e cada página simplesmente referencia. Ao separar esse documento em vários arquivos de saída distintos, a extração de páginas não deduplica os recursos compartilhados entre os novos arquivos independentes — cada arquivo de saída é um PDF autônomo e, portanto, precisa da sua própria cópia completa de cada fonte, imagem ou recurso que suas páginas usam. O resultado prático: o tamanho combinado de todos os arquivos separados pode acabar maior que o do arquivo único original, porque uma fonte armazenada uma vez agora é armazenada uma vez em cada arquivo de saída que a utiliza.

Exemplo: um relatório de 50 páginas com uma fonte incorporada de 2 MB, separado em 10 arquivos individuais de 5 páginas, pode se transformar em dez arquivos que carregam cada um sua própria cópia dessa fonte — cerca de 20 MB de dados de fonte no total em vez dos 2 MB originais, além do conteúdo real das páginas. Isso é um comportamento normal de PDF, não um defeito, e é a mesma contrapartida que qualquer ferramenta de separação enfrenta.

O que Saber

  • Sintaxe de intervalo: digite números de página e intervalos como "1-3, 7, 12-14" — vírgulas separam itens, hífens definem intervalos, e o PDF de saída contém exatamente essas páginas, exatamente nessa ordem.
  • Repetições e intervalos invertidos funcionam: listar um número de página duas vezes o duplica na saída; um intervalo escrito ao contrário (por exemplo, "5-3") extrai essas páginas em ordem inversa.
  • O tamanho total pode crescer: como recursos compartilhados, como fontes, são copiados de forma independente em cada arquivo de saída, não se surpreenda se vários arquivos separados juntos pesarem mais que o original — isso é esperado, não um sinal de corrupção.
  • Nada é renderizado de novo: as páginas são copiadas como objetos estruturados, não repintadas como imagens, então não há perda de qualidade não importa quantas vezes você separe e volte a separar um documento.

Perguntas Frequentes

Posso separar em vários arquivos de uma vez?

Rode a ferramenta uma vez para cada saída — informe o intervalo, baixe, repita. Para lotes de uma página por arquivo em documentos longos, um programa de desktop é mais rápido.

A qualidade muda?

Não — as páginas são copiadas, não renderizadas de novo. O texto continua selecionável e as imagens mantêm a compressão original.

Por que o tamanho total dos meus arquivos separados é maior que o do PDF original?

Porque recursos compartilhados, como fontes incorporadas, são armazenados uma única vez no original, mas são copiados separadamente para cada arquivo de saída independente — a extração não deduplica recursos entre documentos distintos, então o tamanho combinado de vários arquivos separados pode superar o da fonte.

Por que a contagem de páginas é diferente do meu visualizador?

Alguns visualizadores mostram rótulos de página impressos (i, ii, 1, 2...) enquanto esta ferramenta conta páginas físicas a partir de 1. Observe a posição no arquivo, não o rótulo.

As fontes e a formatação continuarão corretas no arquivo separado?

Sim — cada página de saída carrega sua própria cópia completa de cada fonte e recurso de que precisa, então as páginas extraídas são renderizadas de forma idêntica a como apareciam no documento original.

Comentários

Ainda não há comentários — seja o primeiro a escrever um!

Ferramentas Semelhantes