Vous pouvez modifier ou supprimer les métadonnées PDF dans le navigateur : le fichier est ouvert localement, les valeurs titre, auteur, sujet, mots-clés, créateur et producteur sont lues dans un formulaire, vous les modifiez ou les effacez, et une nouvelle copie est enregistrée en téléchargement. Rien n'est téléversé.
Les métadonnées sont le bloc de propriétés de document qui voyage invisiblement avec un PDF. Il nomme généralement la personne ou l'équipe qui a écrit le fichier, le logiciel qui l'a produit, le titre d'origine du document, et tous les mots-clés saisis par l'auteur. Les lecteurs et les moteurs de recherche peuvent tous deux les lire, et toute personne à qui vous envoyez le fichier aussi. Cette page couvre ce que révèle chaque champ, pourquoi cela compte lorsqu'un fichier quitte votre bureau, et les limites honnêtes de ce qu'un outil dans le navigateur peut effacer : il réécrit le dictionnaire d'informations du document, mais un paquet XMP et des clés personnalisées ne sont pas garantis de disparaître.
Un PDF ressemble à un document fini, mais derrière ses pages il porte un petit ensemble de propriétés qui décrivent le fichier lui-même. La plupart des gens n'ouvrent jamais ce panneau, et la plupart des programmes qui enregistrent un PDF le remplissent sans demander. Le résultat est que les fichiers envoyés aux clients, téléversés sur des portails d'emploi et publiés sur des sites publics nomment couramment la personne qui les a écrits et le logiciel qui les a créés.
Métadonnées PDF
Lisez et réécrivez le titre, l'auteur, le sujet, les mots-clés, le créateur et le producteur à l'intérieur d'un PDF, ou effacez les six en un clic. Le fichier est analysé et reconstruit dans votre navigateur, il ne quitte donc jamais votre appareil.
Ce que sont les métadonnées PDF et où elles se cachent
Les métadonnées sont stockées dans le dictionnaire d'informations du document du PDF, un court bloc de texte qui se trouve à côté des pages plutôt qu'à l'intérieur. Il existe pour que les lecteurs, les gestionnaires de fichiers et les systèmes de gestion documentaire puissent identifier un fichier sans d'abord le restituer. Dans la plupart des PDF, les valeurs sont stockées en texte lisible, ce qui signifie que tout ce qui analyse le fichier peut les lire. Cela inclut la personne à qui vous l'envoyez, son portail documentaire, et un moteur de recherche qui indexe le fichier.
Les six champs que cet outil lit et écrit
Cet outil travaille sur les six entrées standard de ce dictionnaire. Les valeurs actuelles sont affichées avant que vous ne changiez quoi que ce soit, vous pouvez donc voir exactement ce qui est déjà dans le fichier au lieu de deviner.
| Champ | Ce qu'elles contiennent habituellement | Pourquoi cela compte |
|---|---|---|
| Titre | Le nom du document qu'un lecteur affiche dans sa fenêtre et son onglet | Les fichiers exportés gardent souvent un nom de travail comme Document1 ou final_v3 |
| Auteur | La personne ou le compte crédité pour le document | Souvent l'auteur du modèle, pas la personne qui envoie le fichier |
| Sujet | Une brève description du contenu | Peut répéter un dossier confidentiel ou un nom de projet |
| Mots-clés | Une liste de balises séparées par des virgules | Peut porter un nom de client, un numéro de dossier ou un code interne |
| Créateur | L'application qui a écrit le document d'origine | Nomme le logiciel et parfois sa version |
| Producteur | La bibliothèque ou le pilote qui a généré le PDF | Peut révéler un modèle de scanner ou une chaîne de compilation interne |
D'où viennent ces valeurs
La plupart des gens ne saisissent jamais rien de tout cela. Une suite bureautique écrit son propre nom dans Créateur et le nom du compte connecté dans Auteur. Un scanner écrit sa marque et son modèle dans Producteur. Un export en PDF estampille Titre avec le nom du fichier que vous avez enregistré. C'est pourquoi deux documents identiques en apparence peuvent porter des traînées complètement différentes, et pourquoi un fichier sans signature visible peut quand même nommer son auteur.
Comment modifier ou supprimer les métadonnées PDF
L'ensemble du travail se fait en trois étapes et sans compte. Le fichier est lu et reconstruit dans l'onglet du navigateur, il n'est donc jamais téléversé.
- Ajoutez le PDF. Déposez un fichier dans l'outil ou cliquez pour parcourir. Le nombre de pages et les six propriétés actuelles sont lus sur votre appareil et listés dans le panneau Résultat.
- Modifiez ou effacez les valeurs. Saisissez un nouveau texte dans Title, Author, Subject, Keywords, Creator ou Producer. Pour tout supprimer d'un coup, cliquez sur Supprimer toutes les métadonnées, ce qui vide les six champs.
- Enregistrez et téléchargez. Cliquez sur Enregistrer les métadonnées. L'outil écrit les nouvelles valeurs, reconstruit le fichier et le télécharge en tant que copie nommée d'après votre original avec -metadata ajouté.
Votre fichier d'origine n'est jamais modifié. Seule la copie téléchargée porte les nouvelles valeurs, vous pouvez donc ouvrir les deux fichiers et comparer leurs propriétés côte à côte.
Pourquoi les métadonnées PDF sont un problème de confidentialité
Les propriétés d'un PDF sont une traînée qui suit le fichier, et c'est rarement la traînée que vous choisiriez de laisser.
Il nomme des personnes qui ne s'attendaient pas à être nommées
Les modèles sont partagés, le champ Author contient donc souvent le nom de celui qui a construit le modèle plutôt que de la personne qui envoie le fichier aujourd'hui. Un ancien collègue, un ancien compte, un prestataire qui est depuis parti : le nom voyage avec le document et est invisible sur la page. Creator et Producer ajoutent une seconde couche en nommant l'application ou le scanner précis qui l'a produit.
Peut exposer un nom de fichier interne ou un titre de travail
Title est souvent copié depuis le nom du fichier exporté, qui peut être une référence interne plutôt que publique. Un brouillon nommé d'après un client encore en négociation, un numéro de dossier, ou un titre de travail que vous n'utiliseriez jamais en public peut se trouver dans ce champ et être lu par quiconque ouvre la boîte de dialogue des propriétés.
Il survit quand la page paraît propre
C'est ce qui rend les métadonnées dignes d'attention. Un PDF peut sembler entièrement anonymisé, sans logo ni signature, et toujours nommer son auteur dans les propriétés du document. Certains portails et outils de recherche indexent ces propriétés, un champ que vous n'avez jamais remarqué peut donc remonter dans une liste à côté d'un titre que vous n'avez pas écrit.
Ce que cet outil peut et ne peut pas effacer
Une déclaration claire des limites est plus utile qu'une promesse d'effacement total. Cet outil réécrit une partie précise d'un PDF et laisse le reste intact.
| Ce que vous voulez supprimer | Cet outil le fait-il | Quoi faire à la place |
|---|---|---|
| Titre, Auteur, Sujet, Mots-clés, Créateur, Producteur | Oui, il lit et réécrit les six | Rien d'autre nécessaire |
| Un paquet de métadonnées XMP | Pas de manière fiable | Traitez le fichier comme s'il le portait encore |
| Clés personnalisées et données d'application privées | Non | Non couvert par cet outil |
| Contenu de page, tampons, en-têtes, signatures | Non, et il ne devrait pas | Modifiez ou masquez les pages séparément |
| Le mot de passe d'un fichier chiffré | Non | Déverrouillez d'abord le PDF, puis modifiez les métadonnées |
Uniquement le dictionnaire d'informations du document
Les six champs vivent dans le dictionnaire d'informations du document, et c'est ce dictionnaire que l'outil lit et écrit. Les valeurs stockées ailleurs dans le fichier sont hors de portée. En pratique, vous devez considérer l'outil comme une correction fiable des propriétés standard, pas comme une gomme à métadonnées universelle.
Les paquets XMP et les clés personnalisées ne sont pas garantis de disparaître
Beaucoup de scanners et de produits Adobe intègrent un second bloc de métadonnées plus riche appelé paquet XMP, qui est distinct du dictionnaire d'informations du document. Comme cet outil réécrit le dictionnaire plutôt que le fichier entier, un paquet XMP n'est pas garanti d'être supprimé. Il en va de même pour les clés personnalisées ajoutées par des logiciels tiers. Si un fichier provient d'un scanner ou d'un pipeline de production, partez du principe que certaines métadonnées subsistent même après avoir effacé les six champs.
Les fichiers chiffrés doivent d'abord être déverrouillés
Un PDF protégé par mot de passe ne peut pas être analysé, l'outil signale donc que le fichier n'a pas pu être ouvert et note qu'il est peut-être protégé par mot de passe ou endommagé. Supprimez le mot de passe avec le Déverrouiller un PDF outil, puis modifiez ici la copie déverrouillée. Si le fichier doit rester verrouillé, faites d'abord la modification des métadonnées et appliquez la protection en dernier.
Effacer les propriétés n'est pas supprimer du contenu
Supprimer toutes les métadonnées vide les six champs et rien d'autre. Les pages, le texte, les images, les liens et les signets sont copiés sans modification, c'est pourquoi la sortie reste sûre à imprimer ou à signer. Si une image de signature, un en-tête ou un pied de page avec un nom est visible sur la page, effacer les propriétés ne le supprime pas. Supprimer du contenu visible est un autre travail, effectué sur les pages elles-mêmes.
Quand conserver les métadonnées au lieu de les supprimer
Supprimer les métadonnées n'est pas toujours la bonne action. Un flux de publication, un système de gestion documentaire et une archive de dossiers s'appuient tous sur Title et Keywords pour classer et trouver les fichiers, et les retirer rend un document plus difficile à gérer. Il en va de même pour les dossiers signés où Creator et Producer aident à établir la provenance.
La règle sensée est de faire correspondre au public. Pour un fichier destiné à un client, un portail public ou une candidature, corrigez ou effacez les champs identifiants. Pour un fichier qui va dans votre propre archive, ou un où les détails de rédaction font partie du dossier, laissez-les en place. L'outil vous permet de modifier un champ au lieu des six, vous pouvez donc conserver les valeurs utiles et retirer seulement les sensibles.
Édition dans le navigateur ou téléversement d'un fichier
La plupart des éditeurs de métadonnées sont des applications serveur : vous téléversez le document, leur machine le réécrit et vous téléchargez le résultat. Cela fonctionne, mais pour les fichiers que les gens veulent le plus nettoyer, contrats, candidatures, dossiers médicaux et scans de pièces d'identité, confier l'original à un tiers est justement le risque que vous cherchiez à réduire.
| Approche | Où va le fichier | Ce à quoi vous renoncez |
|---|---|---|
| Aihangsoft Métadonnées PDF | Reste sur votre appareil | Rien. Sans compte, sans téléversement, sans filigrane |
| Un éditeur serveur typique | Téléversé vers leurs serveurs | Des politiques de conservation et de confidentialité à qui vous devez faire confiance |
Une édition locale signifie aussi que le fichier ne dépend pas d'une connexion dès que la page est chargée. Vous pouvez nettoyer un lot de documents dans un train sans signal, et les originaux sur le disque ne sont jamais modifiés, une exécution dont vous n'êtes pas sûr ne vous coûte donc rien.