Modifier ou supprimer les métadonnées PDF avant d'envoyer un fichier

Vous pouvez modifier ou supprimer les métadonnées PDF dans le navigateur : le fichier est ouvert localement, les valeurs titre, auteur, sujet, mots-clés, créateur et producteur sont lues dans un formulaire, vous les modifiez ou les effacez, et une nouvelle copie est enregistrée en téléchargement. Rien n'est téléversé.

Les métadonnées sont le bloc de propriétés de document qui voyage invisiblement avec un PDF. Il nomme généralement la personne ou l'équipe qui a écrit le fichier, le logiciel qui l'a produit, le titre d'origine du document, et tous les mots-clés saisis par l'auteur. Les lecteurs et les moteurs de recherche peuvent tous deux les lire, et toute personne à qui vous envoyez le fichier aussi. Cette page couvre ce que révèle chaque champ, pourquoi cela compte lorsqu'un fichier quitte votre bureau, et les limites honnêtes de ce qu'un outil dans le navigateur peut effacer : il réécrit le dictionnaire d'informations du document, mais un paquet XMP et des clés personnalisées ne sont pas garantis de disparaître.

Un PDF ressemble à un document fini, mais derrière ses pages il porte un petit ensemble de propriétés qui décrivent le fichier lui-même. La plupart des gens n'ouvrent jamais ce panneau, et la plupart des programmes qui enregistrent un PDF le remplissent sans demander. Le résultat est que les fichiers envoyés aux clients, téléversés sur des portails d'emploi et publiés sur des sites publics nomment couramment la personne qui les a écrits et le logiciel qui les a créés.

Métadonnées PDF

Lisez et réécrivez le titre, l'auteur, le sujet, les mots-clés, le créateur et le producteur à l'intérieur d'un PDF, ou effacez les six en un clic. Le fichier est analysé et reconstruit dans votre navigateur, il ne quitte donc jamais votre appareil.

Ouvrir l'outil

Ce que sont les métadonnées PDF et où elles se cachent

Les métadonnées sont stockées dans le dictionnaire d'informations du document du PDF, un court bloc de texte qui se trouve à côté des pages plutôt qu'à l'intérieur. Il existe pour que les lecteurs, les gestionnaires de fichiers et les systèmes de gestion documentaire puissent identifier un fichier sans d'abord le restituer. Dans la plupart des PDF, les valeurs sont stockées en texte lisible, ce qui signifie que tout ce qui analyse le fichier peut les lire. Cela inclut la personne à qui vous l'envoyez, son portail documentaire, et un moteur de recherche qui indexe le fichier.

Les six champs que cet outil lit et écrit

Cet outil travaille sur les six entrées standard de ce dictionnaire. Les valeurs actuelles sont affichées avant que vous ne changiez quoi que ce soit, vous pouvez donc voir exactement ce qui est déjà dans le fichier au lieu de deviner.

ChampCe qu'elles contiennent habituellementPourquoi cela compte
TitreLe nom du document qu'un lecteur affiche dans sa fenêtre et son ongletLes fichiers exportés gardent souvent un nom de travail comme Document1 ou final_v3
AuteurLa personne ou le compte crédité pour le documentSouvent l'auteur du modèle, pas la personne qui envoie le fichier
SujetUne brève description du contenuPeut répéter un dossier confidentiel ou un nom de projet
Mots-clésUne liste de balises séparées par des virgulesPeut porter un nom de client, un numéro de dossier ou un code interne
CréateurL'application qui a écrit le document d'origineNomme le logiciel et parfois sa version
ProducteurLa bibliothèque ou le pilote qui a généré le PDFPeut révéler un modèle de scanner ou une chaîne de compilation interne

D'où viennent ces valeurs

La plupart des gens ne saisissent jamais rien de tout cela. Une suite bureautique écrit son propre nom dans Créateur et le nom du compte connecté dans Auteur. Un scanner écrit sa marque et son modèle dans Producteur. Un export en PDF estampille Titre avec le nom du fichier que vous avez enregistré. C'est pourquoi deux documents identiques en apparence peuvent porter des traînées complètement différentes, et pourquoi un fichier sans signature visible peut quand même nommer son auteur.

Comment modifier ou supprimer les métadonnées PDF

L'ensemble du travail se fait en trois étapes et sans compte. Le fichier est lu et reconstruit dans l'onglet du navigateur, il n'est donc jamais téléversé.

  1. Ajoutez le PDF. Déposez un fichier dans l'outil ou cliquez pour parcourir. Le nombre de pages et les six propriétés actuelles sont lus sur votre appareil et listés dans le panneau Résultat.
  2. Modifiez ou effacez les valeurs. Saisissez un nouveau texte dans Title, Author, Subject, Keywords, Creator ou Producer. Pour tout supprimer d'un coup, cliquez sur Supprimer toutes les métadonnées, ce qui vide les six champs.
  3. Enregistrez et téléchargez. Cliquez sur Enregistrer les métadonnées. L'outil écrit les nouvelles valeurs, reconstruit le fichier et le télécharge en tant que copie nommée d'après votre original avec -metadata ajouté.

Votre fichier d'origine n'est jamais modifié. Seule la copie téléchargée porte les nouvelles valeurs, vous pouvez donc ouvrir les deux fichiers et comparer leurs propriétés côte à côte.

Pourquoi les métadonnées PDF sont un problème de confidentialité

Les propriétés d'un PDF sont une traînée qui suit le fichier, et c'est rarement la traînée que vous choisiriez de laisser.

Il nomme des personnes qui ne s'attendaient pas à être nommées

Les modèles sont partagés, le champ Author contient donc souvent le nom de celui qui a construit le modèle plutôt que de la personne qui envoie le fichier aujourd'hui. Un ancien collègue, un ancien compte, un prestataire qui est depuis parti : le nom voyage avec le document et est invisible sur la page. Creator et Producer ajoutent une seconde couche en nommant l'application ou le scanner précis qui l'a produit.

Peut exposer un nom de fichier interne ou un titre de travail

Title est souvent copié depuis le nom du fichier exporté, qui peut être une référence interne plutôt que publique. Un brouillon nommé d'après un client encore en négociation, un numéro de dossier, ou un titre de travail que vous n'utiliseriez jamais en public peut se trouver dans ce champ et être lu par quiconque ouvre la boîte de dialogue des propriétés.

Il survit quand la page paraît propre

C'est ce qui rend les métadonnées dignes d'attention. Un PDF peut sembler entièrement anonymisé, sans logo ni signature, et toujours nommer son auteur dans les propriétés du document. Certains portails et outils de recherche indexent ces propriétés, un champ que vous n'avez jamais remarqué peut donc remonter dans une liste à côté d'un titre que vous n'avez pas écrit.

Ce que cet outil peut et ne peut pas effacer

Une déclaration claire des limites est plus utile qu'une promesse d'effacement total. Cet outil réécrit une partie précise d'un PDF et laisse le reste intact.

Ce que vous voulez supprimerCet outil le fait-ilQuoi faire à la place
Titre, Auteur, Sujet, Mots-clés, Créateur, ProducteurOui, il lit et réécrit les sixRien d'autre nécessaire
Un paquet de métadonnées XMPPas de manière fiableTraitez le fichier comme s'il le portait encore
Clés personnalisées et données d'application privéesNonNon couvert par cet outil
Contenu de page, tampons, en-têtes, signaturesNon, et il ne devrait pasModifiez ou masquez les pages séparément
Le mot de passe d'un fichier chiffréNonDéverrouillez d'abord le PDF, puis modifiez les métadonnées

Uniquement le dictionnaire d'informations du document

Les six champs vivent dans le dictionnaire d'informations du document, et c'est ce dictionnaire que l'outil lit et écrit. Les valeurs stockées ailleurs dans le fichier sont hors de portée. En pratique, vous devez considérer l'outil comme une correction fiable des propriétés standard, pas comme une gomme à métadonnées universelle.

Les paquets XMP et les clés personnalisées ne sont pas garantis de disparaître

Beaucoup de scanners et de produits Adobe intègrent un second bloc de métadonnées plus riche appelé paquet XMP, qui est distinct du dictionnaire d'informations du document. Comme cet outil réécrit le dictionnaire plutôt que le fichier entier, un paquet XMP n'est pas garanti d'être supprimé. Il en va de même pour les clés personnalisées ajoutées par des logiciels tiers. Si un fichier provient d'un scanner ou d'un pipeline de production, partez du principe que certaines métadonnées subsistent même après avoir effacé les six champs.

Les fichiers chiffrés doivent d'abord être déverrouillés

Un PDF protégé par mot de passe ne peut pas être analysé, l'outil signale donc que le fichier n'a pas pu être ouvert et note qu'il est peut-être protégé par mot de passe ou endommagé. Supprimez le mot de passe avec le Déverrouiller un PDF outil, puis modifiez ici la copie déverrouillée. Si le fichier doit rester verrouillé, faites d'abord la modification des métadonnées et appliquez la protection en dernier.

Effacer les propriétés n'est pas supprimer du contenu

Supprimer toutes les métadonnées vide les six champs et rien d'autre. Les pages, le texte, les images, les liens et les signets sont copiés sans modification, c'est pourquoi la sortie reste sûre à imprimer ou à signer. Si une image de signature, un en-tête ou un pied de page avec un nom est visible sur la page, effacer les propriétés ne le supprime pas. Supprimer du contenu visible est un autre travail, effectué sur les pages elles-mêmes.

Quand conserver les métadonnées au lieu de les supprimer

Supprimer les métadonnées n'est pas toujours la bonne action. Un flux de publication, un système de gestion documentaire et une archive de dossiers s'appuient tous sur Title et Keywords pour classer et trouver les fichiers, et les retirer rend un document plus difficile à gérer. Il en va de même pour les dossiers signés où Creator et Producer aident à établir la provenance.

La règle sensée est de faire correspondre au public. Pour un fichier destiné à un client, un portail public ou une candidature, corrigez ou effacez les champs identifiants. Pour un fichier qui va dans votre propre archive, ou un où les détails de rédaction font partie du dossier, laissez-les en place. L'outil vous permet de modifier un champ au lieu des six, vous pouvez donc conserver les valeurs utiles et retirer seulement les sensibles.

Édition dans le navigateur ou téléversement d'un fichier

La plupart des éditeurs de métadonnées sont des applications serveur : vous téléversez le document, leur machine le réécrit et vous téléchargez le résultat. Cela fonctionne, mais pour les fichiers que les gens veulent le plus nettoyer, contrats, candidatures, dossiers médicaux et scans de pièces d'identité, confier l'original à un tiers est justement le risque que vous cherchiez à réduire.

ApprocheOù va le fichierCe à quoi vous renoncez
Aihangsoft Métadonnées PDFReste sur votre appareilRien. Sans compte, sans téléversement, sans filigrane
Un éditeur serveur typiqueTéléversé vers leurs serveursDes politiques de conservation et de confidentialité à qui vous devez faire confiance

Une édition locale signifie aussi que le fichier ne dépend pas d'une connexion dès que la page est chargée. Vous pouvez nettoyer un lot de documents dans un train sans signal, et les originaux sur le disque ne sont jamais modifiés, une exécution dont vous n'êtes pas sûr ne vous coûte donc rien.

FAQ

Les métadonnées PDF sont un bloc de propriétés de document stocké à l'intérieur du fichier, distinct des pages visibles. Chaque lecteur PDF courant les expose : dans Adobe Acrobat, choisissez Fichier, puis Propriétés, et dans la plupart des lecteurs gratuits la même boîte de dialogue s'ouvre depuis un élément de menu Propriétés du document ou Afficher les informations du document. Le bloc enregistre six valeurs standard : Title, Author, Subject, Keywords, Creator et Producer. Title est le nom du document que le lecteur affiche dans sa fenêtre, Author est la personne ou l'équipe créditée, Subject est une brève description, Keywords est une liste de balises séparées par des virgules, Creator est l'application qui a écrit le document d'origine, et Producer est la bibliothèque ou le pilote qui a généré le PDF lui-même. Un scanner, une suite bureautique et un export en PDF remplissent chacun ces valeurs automatiquement, c'est pourquoi un fichier que vous n'avez jamais étiqueté peut quand même porter un nom et une empreinte machine.
Ouvrez l'outil Métadonnées PDF et déposez un PDF dans la zone. Le fichier est analysé dans votre navigateur, il n'est donc jamais envoyé à un serveur. Les six valeurs actuelles sont lues dans le formulaire et listées dans le panneau Résultat immédiatement, ce qui signifie que vous pouvez voir ce que le fichier prétend déjà avant de toucher à quoi que ce soit. Pour modifier les métadonnées, saisissez la nouvelle valeur dans n'importe quel champ et cliquez sur Enregistrer les métadonnées. Pour les supprimer, cliquez sur Supprimer toutes les métadonnées, ce qui efface les six champs d'un coup. L'une ou l'autre action écrit la modification dans une copie fraîche et la télécharge sous un nouveau nom, le nom de votre fichier d'origine avec -metadata ajouté. Votre fichier d'origine sur le disque reste exactement tel qu'il était, vous pouvez donc comparer les deux ou relancer l'outil si le premier résultat n'est pas celui que vous vouliez.
Changer l'auteur est la raison la plus courante d'ouvrir un outil comme celui-ci, et cela ne demande qu'un champ. Ajoutez le fichier, remplacez la valeur Auteur par le bon nom ou la bonne équipe, puis cliquez sur Enregistrer les métadonnées. Le même formulaire contient aussi Créateur, qui est l'application qui a écrit le document d'origine, et Producteur, qui est la bibliothèque ou le pilote d'impression qui a généré le PDF. Ces deux derniers portent souvent un nom d'entreprise, un modèle de scanner ou une chaîne de compilation interne, si le but est d'empêcher un document de renvoyer à votre organisation, modifiez ou effacez les trois plutôt que seulement la ligne Auteur. Si vous voulez que le fichier ne porte aucune attribution, Supprimer toutes les métadonnées vide chaque champ en une seule action. Un champ vide est stocké comme une valeur vide, et la plupart des lecteurs n'affichent alors rien pour cette propriété.
Non, et cela vaut la peine d'être précis. Effacer les propriétés du document retire un ensemble évident d'identifiants, mais un PDF peut contenir d'autres traces. Le contenu de la page lui-même n'est pas touché, un en-tête, une image de signature, un tampon scanné ou un pied de page avec un nom et une adresse survivent donc. Le texte que vous pouvez sélectionner reste sélectionnable, ce qui signifie qu'un copier-coller révèle exactement ce qui est écrit. Un paquet de métadonnées XMP, que certains scanners et produits Adobe intègrent séparément du dictionnaire d'informations du document, n'est pas effacé de manière fiable par un outil qui ne réécrit que ce dictionnaire. Pour un document qui doit être anonyme, l'approche la plus sûre est d'effacer les propriétés ici puis de vérifier le contenu visible à la main, ou de restituer les pages en images pour qu'aucune couche de texte cachée ne subsiste. Les métadonnées sont une couche d'un document, et les effacer n'est pas la même chose qu'anonymiser le fichier.
Non. Un PDF chiffré doit être déchiffré avant que sa structure puisse être analysée, et cet outil ne le fait pas. Si vous ajoutez un fichier protégé par mot de passe, l'outil signale qu'il n'a pas pu être ouvert et note qu'il est peut-être protégé par mot de passe ou endommagé. La voie qui fonctionne est de supprimer d'abord le mot de passe avec l'outil Déverrouiller un PDF, puis d'apporter la copie déverrouillée ici et de modifier ses métadonnées. Si le document doit rester verrouillé, lancez la modification des métadonnées d'abord, puis protégez le fichier final, pour que le mot de passe soit appliqué en dernier. Cet ordre compte car réappliquer une protection après la modification ne restaure pas les valeurs que vous avez effacées. Notez aussi que de nombreux fichiers sont restreints plutôt que chiffrés, par exemple avec l'impression ou la copie désactivée ; ces fichiers s'ouvrent généralement et peuvent être modifiés normalement.
Ouvrez le fichier dans n'importe quel lecteur et cherchez ses propriétés de document, ou utilisez cet outil, qui liste les six valeurs dès que le PDF est ajouté. L'outil est la vérification la plus rapide car il lit le fichier localement et affiche les valeurs côte à côte avec les champs de modification, vous voyez donc exactement ce qu'un destinataire verrait sans avoir besoin d'Adobe Acrobat installé. Les trois champs les plus susceptibles de vous gêner sont Author, Creator et Producer : Author est souvent le nom d'un collègue ou d'un ancien compte, Creator est l'application, et Producer est la bibliothèque ou le pilote qui a généré le fichier. Si l'un d'eux révèle quelque chose que vous ne voudriez pas qu'un client ou un portail public voie, modifiez le champ ou effacez le tout avant que le fichier ne quitte votre bureau. La vérification prend environ dix secondes.

Nettoyez les propriétés d'un PDF avant qu'il quitte votre bureau

Gratuit, privé et illimité. Sans compte et sans téléversement.

Ouvrir les métadonnées PDF