Você pode editar ou remover metadados de PDF no navegador: o arquivo é aberto localmente, os valores de título, autor, assunto, palavras-chave, criador e produtor são lidos em um formulário, você os altera ou limpa, e uma nova cópia é salva como um download. Nada é enviado.
Os metadados são o bloco de propriedades do documento que viaja invisivelmente com um PDF. Ele geralmente nomeia a pessoa ou equipe que escreveu o arquivo, o software que o produziu, o título original do documento e quaisquer palavras-chave que o autor digitou. Leitores e mecanismos de busca podem lê-los, e também qualquer um a quem você envie o arquivo. Esta página cobre o que cada campo revela, por que isso importa quando um arquivo sai da sua mesa, e os limites honestos do que uma ferramenta de navegador consegue limpar: ela reescreve o dicionário de informações do documento, mas um pacote XMP e chaves personalizadas não têm garantia de sair.
Um PDF parece um documento finalizado, mas por trás de suas páginas ele carrega um pequeno conjunto de propriedades que descrevem o próprio arquivo. A maioria das pessoas nunca abre esse painel, e a maioria dos programas que salvam um PDF o preenche sem perguntar. O resultado é que arquivos enviados a clientes, enviados a portais de empregos e publicados em sites públicos rotineiramente nomeiam a pessoa que os escreveu e o software que os produziu.
Metadados de PDF
Leia e reescreva o título, autor, assunto, palavras-chave, criador e produtor dentro de um PDF, ou limpe os seis com um clique. O arquivo é analisado e reconstruído no seu navegador, então nunca sai do seu dispositivo.
O que são os metadados de PDF e onde eles se escondem
Os metadados são armazenados no dicionário de informações do documento do PDF, um pequeno bloco de texto que fica ao lado das páginas e não dentro delas. Ele existe para que leitores, gerenciadores de arquivos e sistemas de gestão de documentos possam identificar um arquivo sem renderizá-lo primeiro. Na maioria dos PDFs os valores são armazenados como texto legível, o que significa que qualquer coisa que analise o arquivo consegue lê-los. Isso inclui a pessoa a quem você o envia, o portal de documentos dela e um mecanismo de busca que indexe o arquivo.
Os seis campos que esta ferramenta lê e escreve
Esta ferramenta trabalha com as seis entradas padrão desse dicionário. Os valores atuais são mostrados antes de você mudar qualquer coisa, então você vê exatamente o que já está no arquivo em vez de adivinhar.
| Campo | O que ele costuma conter | Por que importa |
|---|---|---|
| Título | O nome do documento que um leitor mostra em sua janela e aba | Os arquivos exportados muitas vezes mantêm um nome de trabalho como Document1 ou final_v3 |
| Autor | A pessoa ou conta creditada pelo documento | Muitas vezes o autor do modelo, não a pessoa que envia o arquivo |
| Assunto | Uma breve descrição do conteúdo | Pode repetir o nome de um caso ou projeto confidencial |
| Palavras-chave | Uma lista de tags separada por vírgulas | Pode carregar um nome de cliente, um número de caso ou um código interno |
| Criador | O aplicativo que escreveu o documento original | Nomeia o software e, às vezes, sua versão |
| Produtor | A biblioteca ou driver que gerou o PDF | Pode revelar um modelo de scanner ou uma string de build interna |
De onde vêm esses valores
A maioria das pessoas nunca digita nada disso. Uma suíte de escritório escreve seu próprio nome em Criador e o nome da conta conectada em Autor. Um scanner escreve sua marca e modelo em Produtor. Uma exportação para PDF carimba o Título com o nome do arquivo que você salvou. É por isso que dois documentos idênticos podem carregar rastros completamente diferentes, e por que um arquivo sem assinatura visível ainda pode nomear seu autor.
Como editar ou remover metadados de PDF
Todo o trabalho são três passos e nenhuma conta. O arquivo é lido e reconstruído dentro da aba do navegador, então nunca é enviado.
- Adicione o PDF. Solte um arquivo na ferramenta ou clique para selecionar. A contagem de páginas e todas as seis propriedades atuais são lidas no seu dispositivo e listadas no painel de resultado.
- Altere ou limpe os valores. Digite um novo texto em Título, Autor, Assunto, Palavras-chave, Criador ou Produtor. Para remover tudo de uma vez, clique em Remover todos os metadados, que esvazia os seis campos.
- Salve e baixe. Clique em Salvar metadados. A ferramenta grava os novos valores, reconstrói o arquivo e o baixa como uma cópia nomeada a partir do seu original com -metadata acrescentado.
Seu arquivo original nunca é modificado. Apenas a cópia baixada carrega os novos valores, então você pode abrir os dois arquivos e comparar suas propriedades lado a lado.
Por que os metadados de PDF são um problema de privacidade
As propriedades de um PDF são um rastro que segue o arquivo, e raramente é o rastro que você escolheria deixar.
Nomeia pessoas que não esperavam ser nomeadas
Modelos são compartilhados, então o campo Autor muitas vezes contém o nome de quem construiu o modelo e não o da pessoa que envia o arquivo hoje. Um ex-colega, uma conta antiga, um prestador que já saiu: o nome viaja com o documento e é invisível na página. Criador e Produtor adicionam uma segunda camada ao nomearem o aplicativo ou scanner específico que o produziu.
Pode expor um nome de arquivo interno ou um título de trabalho
O Título muitas vezes é copiado do nome do arquivo exportado, que pode ser uma referência interna e não pública. Um rascunho nomeado a partir de um cliente ainda em negociação, um número de caso ou um título de trabalho que você nunca usaria em público pode ficar nesse campo e ser lido por qualquer um que abra a caixa de diálogo de propriedades.
Sobrevive quando a página parece limpa
Isso é o que torna os metadados dignos de atenção. Um PDF pode parecer totalmente anonimizado, sem logo e sem assinatura, e ainda nomear seu autor nas propriedades do documento. Alguns portais e ferramentas de busca indexam essas propriedades, então um campo que você nunca notou pode aparecer em uma listagem ao lado de um título que você não escreveu.
O que esta ferramenta consegue e não consegue limpar
Uma declaração clara dos limites é mais útil que uma promessa de limpeza total. Esta ferramenta reescreve uma parte específica de um PDF e deixa o resto intacto.
| O que você quer remover | Esta ferramenta faz isso | O que fazer em vez disso |
|---|---|---|
| Título, Autor, Assunto, Palavras-chave, Criador, Produtor | Sim, ele lê e reescreve os seis | Nada mais necessário |
| Um pacote de metadados XMP | Não de forma confiável | Trate o arquivo como se ainda o carregasse |
| Chaves personalizadas e dados privados do aplicativo | Não | Não coberto por esta ferramenta |
| Conteúdo da página, carimbos, papéis timbrados, assinaturas | Não, e não deveria | Edite ou tarje as páginas separadamente |
| A senha em um arquivo criptografado | Não | Desbloqueie o PDF primeiro, depois edite os metadados |
Somente o dicionário de informações do documento
Os seis campos ficam no dicionário de informações do documento, e esse dicionário é o que a ferramenta lê e escreve. Valores armazenados em outros lugares do arquivo estão fora do escopo. Na prática você deve tratar a ferramenta como uma correção confiável das propriedades padrão, e não como um apagador universal de metadados.
Pacotes XMP e chaves personalizadas não têm garantia de sair
Muitos scanners e produtos Adobe incorporam um segundo bloco de metadados, mais rico, chamado pacote XMP, que é separado do dicionário de informações do documento. Como esta ferramenta reescreve o dicionário e não o arquivo inteiro, um pacote XMP não tem garantia de ser removido. O mesmo vale para chaves personalizadas adicionadas por softwares de terceiros. Se um arquivo veio de um scanner ou de um pipeline de produção, presuma que alguns metadados permanecem mesmo depois de você limpar os seis campos.
Arquivos criptografados precisam ser desbloqueados primeiro
Um PDF protegido por senha não pode ser analisado, então a ferramenta informa que o arquivo não pôde ser aberto e observa que ele pode estar protegido por senha ou danificado. Remova a senha com o Desbloquear PDF ferramenta, depois edite a cópia desbloqueada aqui. Se o arquivo precisar permanecer bloqueado, faça a edição dos metadados primeiro e aplique a proteção por último.
Limpar propriedades não é excluir conteúdo
Remover todos os metadados esvazia os seis campos e nada mais. Páginas, texto, imagens, links e marcadores são copiados sem alterações, e é por isso que a saída continua segura para imprimir ou assinar. Se uma imagem de assinatura, um papel timbrado ou um rodapé com um nome estiver visível na página, limpar as propriedades não o remove. Remover conteúdo visível é um trabalho diferente, feito nas próprias páginas.
Quando manter os metadados em vez de removê-los
Remover os metadados nem sempre é a decisão certa. Um fluxo de publicação, um sistema de gestão de documentos e um arquivo de registros dependem de Título e Palavras-chave para arquivar e encontrar arquivos, e removê-los deixa um documento mais difícil de gerenciar. O mesmo vale para registros assinados, em que Criador e Produtor ajudam a estabelecer a proveniência.
A regra sensata é combinar com o público. Para um arquivo que vai para um cliente, um portal público ou uma candidatura de emprego, corrija ou limpe os campos identificadores. Para um arquivo que vai para o seu próprio arquivo, ou um em que os detalhes de autoria fazem parte do registro, deixe-os no lugar. A ferramenta permite alterar um campo em vez de todos os seis, então você pode manter os valores úteis e remover apenas os sensíveis.
Edição no navegador vs enviar um arquivo
A maioria dos editores de metadados são aplicações de servidor: você envia o documento, a máquina deles o reescreve e você baixa o resultado. Isso funciona, mas para os exatos arquivos que as pessoas mais querem limpar, contratos, inscrições, prontuários médicos e digitalizações de documentos de identidade, entregar o original a um terceiro é o risco que você estava tentando reduzir.
| Abordagem | Para onde vai o arquivo | O que você abre mão |
|---|---|---|
| Metadados de PDF da Aihangsoft | Fica no seu dispositivo | Nada. Sem conta, sem upload, sem marca d'água |
| Um editor de servidor típico | Enviado para os servidores deles | Políticas de retenção e privacidade nas quais você precisa confiar |
Uma edição local também significa que o arquivo não depende de uma conexão a partir do momento em que a página carregou. Você pode limpar um lote de documentos em um trem sem sinal, e os originais no disco nunca são alterados, então uma execução da qual você não tem certeza não custa nada.