Informações do PDF: veja o que tem dentro de um PDF
Solte um PDF e veja do que ele é feito: quantas páginas tem, o tamanho exato de cada uma, qual é a página fora do padrão, o que os metadados dizem e qual programa escreveu o arquivo. O PDF é lido pelo seu navegador e nunca sai do seu dispositivo.
Solte um PDF aqui ou procure no computador
Um arquivo por vez · lido no seu dispositivo · nada é enviado
Um ponto é 1/72 de polegada. É a unidade que o PDF guarda internamente, então as outras duas são convertidas.
O que existe de fato dentro de um arquivo PDF
Um PDF é um saco de objetos numerados — dicionários, vetores, números, cadeias e fluxos de bytes comprimidos — seguido de uma tabela de referências cruzadas que anota o deslocamento em bytes de cada um, e de um trailer que aponta para o catálogo do documento. O catálogo aponta para uma árvore de páginas, a árvore lista as páginas, e cada página aponta para seu fluxo de conteúdo e seus recursos. Nada é guardado em ordem de leitura e nada é guardado como uma foto da página. O leitor pula pelo arquivo usando deslocamentos, e é por isso que um manual de 900 páginas pode abrir na página 900 sem decodificar as 899 anteriores.
Esse desenho também é o ponto fraco do formato. Quando os deslocamentos da tabela estão errados — e scanners, preenchedores de formulário e bibliotecas de exportação baratas os escrevem errado com frequência —, um leitor rigoroso declara o arquivo quebrado enquanto os objetos continuam ali, intactos. Esta ferramenta reconstrói o índice varrendo o arquivo atrás de cabeçalhos de objeto quando a tabela não serve, e avisa quando precisou fazer isso. Esse arquivo ainda abre na maioria dos leitores, mas salve-o de novo em um aplicativo de PDF antes de mandar para algum lugar que importe.
Por que os tamanhos de página são a parte mais útil daqui
A geometria da página é guardada em pontos, e um ponto é 1/72 de polegada. US Letter é 612 × 792 e A4 é 595.28 × 841.89: os decimais estranhos são o que dá 210 × 297 milímetros. Esses números não são uma sugestão para a impressora; são a página. Um documento com 119 páginas A4 e uma Letter imprime como 119 páginas corretas e uma que sai escalada, deslocada ou de outra bandeja, e ninguém sabe qual foi.
Por isso esta ferramenta agrupa as páginas consecutivas em faixas. Uma faixa é cortada onde muda o tamanho, a orientação ou o corte, e é marcada toda página cujo tamanho de folha não bate com o da maioria. Uma linha só dizendo "1–240, A4" é um documento que vai imprimir de forma previsível. Seis linhas são um documento costurado a partir de várias fontes, e é ali que estão as emendas.
Por que uma página tem um MediaBox e também um CropBox?
Toda página carrega um MediaBox: a folha inteira, de canto a canto, em pontos. A maioria carrega também um CropBox, a região que o visualizador mostra e que a impressora imprime. Normalmente são idênticos. Quando não são, alguém cortou a página — e cortar um PDF quase nunca remove nada. O conteúdo fora do CropBox continua no arquivo, continua selecionável por qualquer ferramenta que ignore a caixa, e continua visível para quem aumentar o corte de novo. Se você cortou um PDF para esconder alguma coisa, um CropBox menor que o MediaBox é o aviso de que você não escondeu. A caixa de corte aparece aqui sempre que ela é menor que a folha. Um CropBox maior que o MediaBox está malformado e não muda nada — o leitor mostra a parte em que os dois coincidem —, então ele não é informado como corte.
Por que a rotação é metadado e não pixel?
Uma página virada de lado não é redesenhada. O conteúdo fica exatamente como estava e a página ganha uma entrada de rotação de 90, 180 ou 270 graus, que todo leitor aplica na hora de exibir. É por isso que endireitar uma digitalização de 400 MB é instantâneo e sem perda, e também por isso que uma impressora teimosa de vez em quando ignora a entrada e imprime a página do jeito que ela foi guardada. Os tamanhos listados aqui já têm a rotação aplicada, então mostram a forma com que a página se apresenta, não a forma com que ela foi desenhada. Uma página virada não conta de propósito como um tamanho de folha diferente: ela passa pela impressora no mesmo papel, e marcá-la esconderia a página que está de fato errada.
Creator, Producer e em qual acreditar
Dois campos de metadados são confundidos o tempo todo. Creator é o programa onde o conteúdo foi escrito: Word, InDesign, o software de um scanner. Producer é a biblioteca que escreveu os bytes do PDF. Producer costuma ser o mais informativo dos dois: ele diz se o arquivo saiu do Acrobat Distiller, do Ghostscript, de um "imprimir em PDF" do navegador ou de um script em Python, e isso diz o que esperar do arquivo. As datas são guardadas como cadeias de data de PDF, no estilo D:20240115103000+01'00', e aparecem aqui em formato ISO, com o fuso incluído. Tudo isso é texto livre escrito por aquilo que produziu o arquivo, então leia como uma afirmação, não como um fato.
O que esta ferramenta não consegue dizer
- Ela não abre um PDF protegido por senha. Arquivos criptografados são recusados, não contornados. Tire a senha no aplicativo que fez o arquivo e volte depois.
- Ela não desenha as páginas. Não há pré-visualização, porque desenhar uma página de PDF exige um motor de fontes e um rasterizador: cerca de um megabyte de código que todo mundo que abrisse esta página teria que baixar.
- Ela não extrai texto, fontes nem imagens, e não consegue dizer por que um arquivo é grande. Ela informa o tamanho, não uma divisão dele.
- Ela lê o dicionário Info clássico, não o XMP. Muitos arquivos modernos carregam um segundo bloco de metadados em XMP e às vezes os dois não batem, então um título que aqui parece vazio pode continuar existindo no XMP.
- A versão mostrada é a do cabeçalho do arquivo. O catálogo do documento pode sobrescrevê-la, e essa sobrescrita não é lida.
- A visualização rápida na web é lida do começo do arquivo. Se alguém salvou alterações por cima de um PDF linearizado, a marca sobrevive mas a disposição não, então um sim aqui significa "foi construído assim" e não "ainda está assim".
Tudo isso acontece na página que você está olhando. O PDF é lido com a API de arquivos do próprio navegador, nada é enviado para lugar nenhum, e a ferramenta continua funcionando com a rede desconectada.
Perguntas frequentes
Como vejo o tamanho de página de um PDF?
Abra o arquivo nesta ferramenta e olhe a tabela de tamanhos de página, que lista cada faixa de páginas com a largura e a altura em milímetros, polegadas ou pontos. Um PDF guarda a geometria em pontos, a 72 pontos por polegada, então A4 aparece como 595.28 × 841.89 pontos e US Letter como 612 × 792.
Por que uma página do meu PDF imprime no papel errado?
Quase sempre porque essa página tem um tamanho diferente das outras, normalmente porque o documento foi montado a partir de mais de uma fonte. A impressora trata cada página por conta própria, então uma única página Letter dentro de um documento A4 sai escalada ou de outra bandeja. Esta ferramenta marca qualquer página cujo tamanho não bate com a maioria.
Dá para ver quem criou um PDF?
Dá para ver o que o arquivo afirma. O campo Creator nomeia o programa onde o conteúdo foi escrito e o campo Producer nomeia a biblioteca que escreveu os bytes do PDF, junto com um autor e uma data de criação quando alguém os preencheu. Tudo isso é texto livre colocado pelo software, então pode estar errado, vazio ou ser deliberadamente enganoso.
O que significa "linearizado" ou "visualização rápida na web" em um PDF?
Significa que o arquivo foi organizado para que um leitor consiga mostrar a primeira página antes de o resto terminar de baixar, com um dicionário especial no começo e os objetos da página um agrupados perto dele. Não muda nada para um arquivo que você já tem no disco. Salvar alterações por cima de um PDF linearizado normalmente quebra essa disposição e deixa a marca no lugar.
Esta ferramenta abre um PDF protegido por senha?
Não. Um PDF criptografado é recusado com uma mensagem em vez de quebrado, e nenhuma ferramenta deste site tenta burlar uma senha. Tire a proteção no aplicativo que criou o documento e depois leia a cópia aqui.
Meu PDF é enviado para algum lugar?
Não. O arquivo é lido por JavaScript rodando no seu navegador, com a mesma API de arquivos que qualquer página usa para mostrar uma foto que você escolheu. Abra as ferramentas de desenvolvedor, olhe a aba Rede enquanto carrega um PDF e você não verá nenhuma requisição. Desconectar da internet depois que a página carrega não impede o funcionamento.
Última atualização 19 de setembro de 2026