O que seu PDF conta sobre você

Cada PDF registra coisas que você nunca digitou: um nome de autor puxado da conta que o criou, o software que o produziu, quando foi criado e modificado por último, e muitas vezes um pacote de metadados embutido com os mesmos detalhes de novo. Este guia lista tudo isso e mostra como remover o que você escolher.

Remover metadados do PDF

O que um PDF diz de você

As propriedades do documento guardam um título, um autor, um assunto e palavras-chave, mais o nome do programa que criou o arquivo e o nome do programa que o produziu. O autor é normalmente seu nome de conta, e o produtor normalmente nomeia seu software e sua versão.

Junto disso, há data de criação e de modificação, ambas exatas ao segundo. Num documento que você diz ter escrito na semana passada, uma data de criação desta manhã é o detalhe que entrega você.

As partes que as pessoas perdem

Muitos PDFs também levam um pacote de metadados XMP, que é um bloco separado com quase a mesma informação em outro formato. Limpar as propriedades do documento num leitor normal muitas vezes deixa esse pacote para trás — então os dados que você achava removidos ainda podem ser lidos.

Também há um identificador de documento guardado no arquivo, e pode haver anexos, que levam seus próprios nomes de arquivo. Uma planilha anexa a um relatório diz a quem olhar como se chamava e de onde veio.

Olhe antes de tirar

Abra a análise de privacidade e escolha o arquivo. Ela lista o que há de fato, agrupado como detalhes do documento, software, datas, arquivos embutidos e outros metadados, com o valor de cada campo mostrado para você ler.

Ver os valores é o ponto. As pessoas se surpreendem ao ver quais campos trazem seu nome real, um empregador antigo, um autor de modelo ou um caminho de arquivo — e não dá para decidir com sensatez sobre um campo cujo conteúdo você não viu. A rota de remoção de metadados cobre este trabalho e leva à mesma ferramenta.

Remova o que você escolher

Selecione as entradas a remover e salve. Você escolhe por item, e não tudo ou nada — o que importa quando um título é realmente útil e um nome de autor não. Ao menos um item precisa ser selecionado, senão não há nada para fazer.

A ferramenta depois faz duas conferências. Compara cada página da saída com a entrada, para que o documento em si não mude, e reabre o arquivo e confirma que cada item selecionado sumiu de verdade, e não só foi apagado.

O efeito lateral que vale conhecer

Unir documentos e organizar páginas limpam as propriedades do documento como parte do trabalho, porque cada um constrói um documento novo. Um arquivo que passou por qualquer um desses não leva título, autor, produtor nem datas da sua origem.

Isso não substitui a análise de privacidade, que é intencional e mostra o que encontrou. Significa, sim, que um arquivo unido muitas vezes já sai limpo dos campos que preocupam — e vale a pena conferir em vez de supor.

O que isso não alcança

A análise lê o que o PDF registra de si mesmo. Não abre as fotos dentro das páginas — então dados de câmera e localização guardados dentro de uma fotografia embutida são outra camada. Limpe isso na sua fototeca antes de as imagens virarem páginas de PDF.

Também não toca conteúdo visível na página. Um nome impresso num rodapé, um bloco de assinatura ou um cabeçalho é conteúdo de página, e remover isso de forma permanente é tarja, que destrói o conteúdo em vez de escondê-lo.

O que as guias de metadados que rankeiam listam

As guias que rankeiam para esta busca concordam em quatro métodos. A página da Smallpdf os nomeia direto: uma ferramenta online, propriedades de documento num editor PDF, tarja ou higienização, e imprimir para PDF para uma cópia limpa, com prós e contras de cada um. A página central da Adobe ordena o mesmo trabalho em quatro passos. Essas são afirmações das páginas deles, não medições feitas aqui.

A pegadinha que este guia adiciona é a que as listas de métodos pulam: limpar propriedades num leitor normal deixa para trás o pacote XMP, então os dados que você achava removidos ainda podem ser lidos. Por isso a ordem aqui é ver primeiro via análise de privacidade (agrupado como detalhes, software, datas, arquivos embutidos e o resto) e só depois remover. Imprimir para PDF sim faz uma cópia limpa, mas também achata todo o resto do arquivo — então é o último recurso, e não o primeiro.

Antes de publicar

Passe a análise no arquivo que você realmente envia, não na versão que você editou três passos atrás. Cada salvamento em cada programa reescreve o campo de produtor e o tempo de modificação — então a última exportação é a que importa.

Os arquivos criptografados são recusados, então desbloqueie primeiro uma cópia se o documento está protegido. O guia de páginas em branco cobre deixar um documento em ordem antes de enviar, a página de privacidade explica o que este site registra, e o centro de páginas lista o resto do grupo.

Perguntas frequentes

Que dados pessoais um PDF guarda de verdade?
Um título, autor, assunto e palavras-chave, o software criador e produtor, marcas de tempo de criação e modificação, um identificador de documento, e muitas vezes um pacote XMP repetindo esses detalhes. Os anexos também levam seus próprios nomes de arquivo.
Por que meu nome continua no arquivo após limpar as propriedades?
Normalmente porque o pacote de metadados XMP ficou para trás. Ele guarda os mesmos detalhes num bloco separado, e limpar o diálogo de propriedades num leitor muitas vezes não o toca.
Posso conservar o título e remover só o autor?
Sim. Você seleciona as entradas a remover uma a uma, então um título útil pode ficar enquanto o nome de autor sai. Ao menos um item precisa ser selecionado para haver algo para fazer.
Remover metadados muda as páginas?
Não. A saída se compara página a página com a entrada, e a ferramenta confirma por separado que cada item selecionado sumiu, e não só foi apagado. O documento em si fica intacto.

Faça agora

A ferramenta funciona neste navegador. Seu arquivo não sai do dispositivo, e o resultado é verificado antes de baixar.

Remover metadados do PDF

Para onde ir agora