Pular para o conteúdo
100% local · 0 KB enviadosComprimir PDF

Compressão PDF explicada

«Comprimir este PDF» parece uma única operação, mas um PDF pode ser comprimido de várias formas independentes. Saber qual é qual ajuda a entender o que uma ferramenta de compressão pode e não pode fazer, e por que alguns PDFs reduzem drasticamente enquanto outros mal mudam.

Fundamentos

Com perda vs sem perda

A compressão sem perda reduz o tamanho do arquivo sem perder nenhuma informação — os dados descomprimidos são idênticos byte a byte ao original. A compressão com perda aceita pequenas mudanças visuais em troca de tamanhos muito menores. Fotos são geralmente comprimidas com perda (JPEG); texto e arte vetorial são geralmente comprimidos sem perda (Flate).

Uma boa ferramenta de compressão PDF aplica compressão com perda apenas às imagens, e apenas quando o compromisso de qualidade é aceitável. Texto e gráficos vetoriais devem sempre ser preservados exatamente.

Imagens

Compressão de imagens em PDFs

PDFs podem armazenar imagens com vários codecs:

  • JPEG — com perda, bom para fotografias. A fonte mais comum de tamanho em PDFs ricos em imagens.
  • Flate (zlib) — sem perda, bom para arte vetorial e imagens com poucas cores.
  • JBIG2 — com ou sem perda, projetado para texto digitalizado bitonal (preto e branco). Pode reduzir drasticamente páginas digitalizadas, mas o suporte é irregular.
  • CCITT Group 4 — sem perda, a compressão de fax clássica para imagens bitonais.

Recodificar uma imagem de um JPEG muito grande para um menor é a redução de tamanho mais eficaz para a maioria dos PDFs.

Fontes

Subconjuntos de fontes

Como abordado no guia de tamanho de arquivo, fontes incorporadas podem dominar um PDF pequeno. O subconjunto incorpora apenas os glifos realmente utilizados. Um documento que usa uma fonte de 250 Ko para um único título pode cair para um subconjunto de 8 Ko sem mudança visível. A maioria dos escritores PDF modernos cria subconjuntos por padrão; os antigos ou alguns caminhos de exportação não o fazem.

Estrutura

Fluxos de objetos

O PDF 1.5 introduziu os fluxos de objetos: uma forma de empacotar pequenos objetos (metadados, descrições de página, descritores de fonte) em um único fluxo comprimido. PDFs antigos armazenam cada objeto separadamente com sua própria sobrecarga. Regravar com fluxos de objetos pode retirar uma porcentagem significativa de documentos ricos em texto sem tocar nenhum conteúdo visível.

Esta é a parte da compressão que é sempre segura — é puramente estrutural, sem perda e invisível para o leitor.

Limites

O que a compressão não pode fazer

Uma passagem de compressão sem perda não reduz um PDF que já está bem codificado. Se o arquivo já usa fluxos de objetos, cria subconjuntos de suas fontes e armazena as imagens em JPEGs razoavelmente comprimidos, resta pouca gordura estrutural para retirar. Ferramentas que prometem reduções drásticas em qualquer arquivo geralmente aplicam recodificação de imagem com perda silenciosamente — o que pode ser bom, mas é uma decisão de qualidade que você deveria tomar conscientemente, não uma refeição gratuita.

A criptografia também é ortogonal à compressão. Criptografar um PDF adiciona uma pequena sobrecarga mas não muda significativamente a qualidade da compressão do conteúdo, pois os fluxos comprimidos são criptografados como bytes. Um PDF comprimido e depois criptografado é ao mesmo tempo menor e protegido.

Na prática

O que uma ferramenta de compressão faz

Quando você passa um PDF por uma ferramenta decomprimir PDF, as etapas seguras e sem perda são: regravar com fluxos de objetos, remover objetos não referenciados e compactar a tabela de referências cruzadas. Apenas isso reduz frequentemente o tamanho em 10–40 % em documentos de exportadores antigos. Ganhos maiores exigem recodificar as imagens, o que é uma decisão com perda separada que o usuário deveria tomar conscientemente.

Leia também

Recursos relacionados

Leia também

Guias relacionados