Du kannst PDF-Metadaten im Browser bearbeiten oder entfernen: Die Datei wird lokal geöffnet, die Werte für Titel, Autor, Betreff, Schlüsselwörter, Ersteller und Produzent werden in ein Formular gelesen, du änderst oder löschst sie, und eine neue Kopie wird als Download gespeichert. Nichts wird hochgeladen.
Metadaten sind der Block von Dokumenteigenschaften, der unsichtbar mit einem PDF reist. Er nennt üblicherweise die Person oder das Team, die die Datei geschrieben hat, die Software, die sie erzeugt hat, den ursprünglichen Dokumenttitel und alle Schlüsselwörter, die der Autor eingegeben hat. Betrachter und Suchmaschinen können ihn beide lesen, und ebenso jeder, an den du die Datei sendest. Diese Seite behandelt, was jedes Feld verrät, warum das zählt, wenn eine Datei deinen Schreibtisch verlässt, und die ehrlichen Grenzen dessen, was ein Browser-Tool löschen kann: Es schreibt das Dokumentinformationen-Wörterbuch neu, aber ein XMP-Paket und benutzerdefinierte Schlüssel sind nicht garantiert entfernt.
Ein PDF sieht wie ein fertiges Dokument aus, aber hinter seinen Seiten trägt es eine kleine Gruppe von Eigenschaften, die die Datei selbst beschreiben. Die meisten Menschen öffnen dieses Panel nie, und die meisten Programme, die ein PDF speichern, füllen es aus, ohne zu fragen. Das Ergebnis ist, dass Dateien, die an Kunden gesendet, in Jobportale hochgeladen und auf öffentlichen Seiten veröffentlicht werden, routinemäßig die Person nennen, die sie geschrieben hat, und die Software, die sie erzeugt hat.
PDF-Metadaten
Lies und schreibe den Titel, Autor, Betreff, Schlüsselwörter, Ersteller und Produzent innerhalb eines PDF neu, oder lösche alle sechs mit einem Klick. Die Datei wird in deinem Browser geparst und neu aufgebaut, sie verlässt dein Gerät also nie.
Was PDF-Metadaten sind und wo sie sich verstecken
Metadaten werden im Dokumentinformationen-Wörterbuch des PDF gespeichert, einem kurzen Textblock, der neben den Seiten liegt und nicht in ihnen. Er existiert, damit Betrachter, Dateimanager und Dokumentenmanagementsysteme eine Datei identifizieren können, ohne sie zuerst zu rendern. In den meisten PDFs werden die Werte als lesbarer Text gespeichert, alles, was die Datei parst, kann sie also lesen. Das schließt die Person ein, an die du sie sendest, ihr Dokumentenportal und eine Suchmaschine, die die Datei indexiert.
Die sechs Felder, die dieses Tool liest und schreibt
Dieses Tool arbeitet an den sechs Standardeinträgen dieses Wörterbuchs. Die aktuellen Werte werden angezeigt, bevor du etwas änderst, du siehst also genau, was bereits in der Datei steht, statt zu raten.
| Feld | Was es üblicherweise enthält | Warum es zählt |
|---|---|---|
| Titel | Der Dokumentname, den ein Betrachter in seinem Fenster und Tab zeigt | Exportierte Dateien behalten oft einen Arbeitsnamen wie Document1 oder final_v3 |
| Autor | Die Person oder das Konto, der die Datei zugerechnet wird | Oft der Vorlagenautor, nicht die Person, die die Datei sendet |
| Betreff | Eine kurze Beschreibung des Inhalts | Kann eine vertrauliche Angelegenheit oder einen Projektnamen wiederholen |
| Schlüsselwörter | Eine kommagetrennte Tag-Liste | Kann einen Kundennamen, eine Aktennummer oder einen internen Code tragen |
| Ersteller | Die Anwendung, die das Originaldokument geschrieben hat | Nennt die Software und manchmal ihre Version |
| Produzent | Die Bibliothek oder der Treiber, der das PDF erzeugt hat | Kann ein Scannermodell oder einen internen Build-String verraten |
Woher diese Werte kommen
Die meisten Menschen geben nichts davon selbst ein. Eine Office-Suite schreibt ihren eigenen Namen in Ersteller und den Namen des angemeldeten Kontos in Autor. Ein Scanner schreibt seine Marke und sein Modell in Produzent. Ein Export in PDF stempelt den Namen der gespeicherten Datei in Titel. Deshalb können zwei identisch aussehende Dokumente völlig unterschiedliche Spuren tragen, und deshalb kann eine Datei ohne sichtbare Autorenzeile trotzdem ihren Autor nennen.
So bearbeitest oder entfernst du PDF-Metadaten
Die ganze Aufgabe umfasst drei Schritte und kein Konto. Die Datei wird im Browser-Tab gelesen und neu aufgebaut, sie wird also nie hochgeladen.
- PDF hinzufügen. Ziehe eine Datei in das Tool oder klicke zum Durchsuchen. Die Seitenzahl und alle sechs aktuellen Eigenschaften werden auf deinem Gerät gelesen und im Ergebnisbereich aufgelistet.
- Die Werte ändern oder löschen. Gib neuen Text in Titel, Autor, Betreff, Schlüsselwörter, Ersteller oder Produzent ein. Um alles auf einmal zu entfernen, klicke auf Alle Metadaten entfernen, was alle sechs Felder leert.
- Speichern und herunterladen. Klicke auf Metadaten speichern. Das Tool schreibt die neuen Werte, baut die Datei neu auf und lädt sie als Kopie herunter, die nach deinem Original mit angehängtem -metadata benannt ist.
Deine Originaldatei wird nie verändert. Nur die heruntergeladene Kopie trägt die neuen Werte, du kannst also beide Dateien öffnen und ihre Eigenschaften nebeneinander vergleichen.
Warum PDF-Metadaten ein Datenschutzproblem sind
Die Eigenschaften eines PDF sind eine Spur, die der Datei folgt, und es ist selten die Spur, die du hinterlassen würdest.
Es nennt Personen, die nicht erwartet haben, genannt zu werden
Vorlagen werden weitergegeben, das Autor-Feld enthält also oft den Namen der Person, die die Vorlage erstellt hat, und nicht die Person, die die Datei heute sendet. Eine ehemalige Kollegin, ein altes Konto, ein Auftragnehmer, der inzwischen gegangen ist: Der Name reist mit dem Dokument und ist auf der Seite unsichtbar. Ersteller und Produzent fügen eine zweite Ebene hinzu, indem sie die konkrete Anwendung oder den Scanner nennen, der es erzeugt hat.
Es kann einen internen Dateinamen oder einen Arbeitstitel offenlegen
Der Titel wird oft aus dem Namen der exportierten Datei übernommen, der eher eine interne Referenz als eine öffentliche sein kann. Ein Entwurf, der nach einem noch in Verhandlung befindlichen Kunden benannt ist, eine Aktennummer oder ein Arbeitstitel, den du nie öffentlich verwenden würdest, kann in diesem Feld stehen und von jedem gelesen werden, der den Eigenschaften-Dialog öffnet.
Es überlebt, wenn die Seite sauber aussieht
Genau das macht Metadaten überlegenswert. Ein PDF kann vollständig anonymisiert aussehen, ohne Logo und ohne Autorenzeile, und trotzdem seinen Autor in den Dokumenteigenschaften nennen. Manche Portale und Suchwerkzeuge indexieren diese Eigenschaften, ein Feld, das du nie bemerkt hast, kann also in einer Auflistung neben einem Titel auftauchen, den du nicht geschrieben hast.
Was dieses Tool löschen kann und was nicht
Eine klare Aussage über die Grenzen ist nützlicher als ein Versprechen einer vollständigen Löschung. Dieses Tool schreibt einen bestimmten Teil eines PDF neu und lässt den Rest unangetastet.
| Was du entfernen willst | Macht dieses Tool das | Was stattdessen zu tun ist |
|---|---|---|
| Titel, Autor, Betreff, Schlüsselwörter, Ersteller, Produzent | Ja, es liest und schreibt alle sechs | Sonst nichts nötig |
| Ein XMP-Metadatenpaket | Nicht zuverlässig | Behandle die Datei so, als trüge sie sie noch |
| Benutzerdefinierte Schlüssel und private Anwendungsdaten | Nein | Von diesem Tool nicht abgedeckt |
| Seiteninhalt, Stempel, Briefköpfe, Signaturen | Nein, und es sollte nicht | Die Seiten getrennt bearbeiten oder schwärzen |
| Das Passwort einer verschlüsselten Datei | Nein | Das PDF zuerst entsperren, dann Metadaten bearbeiten |
Nur das Dokumentinformationen-Wörterbuch
Die sechs Felder liegen im Dokumentinformationen-Wörterbuch, und genau dieses Wörterbuch liest und schreibt das Tool. Werte, die anderswo in der Datei gespeichert sind, sind außerhalb des Rahmens. In der Praxis solltest du das Tool als zuverlässige Korrektur für die Standardeigenschaften behandeln und nicht als universellen Metadaten-Radierer.
XMP-Pakete und benutzerdefinierte Schlüssel sind nicht garantiert entfernt
Viele Scanner und Adobe-Produkte betten einen zweiten, reicheren Metadatenblock namens XMP-Paket ein, der vom Dokumentinformationen-Wörterbuch getrennt ist. Weil dieses Tool das Wörterbuch neu schreibt und nicht die ganze Datei, ist ein XMP-Paket nicht garantiert entfernt. Dasselbe gilt für benutzerdefinierte Schlüssel, die von Drittanbieter-Software hinzugefügt wurden. Wenn eine Datei von einem Scanner oder einer Produktionspipeline stammt, geh davon aus, dass selbst nach dem Leeren der sechs Felder einige Metadaten bleiben.
Verschlüsselte Dateien müssen zuerst entsperrt werden
Ein passwortgeschütztes PDF kann nicht geparst werden, das Tool meldet also, dass die Datei nicht geöffnet werden konnte, und merkt an, dass sie passwortgeschützt oder beschädigt sein könnte. Entferne das Passwort mit dem PDF entsperren Tool, bearbeite dann die entsperrte Kopie hier. Wenn die Datei gesperrt bleiben muss, erledige die Metadatenbearbeitung zuerst und wende den Schutz zuletzt an.
Eigenschaften zu löschen ist nicht dasselbe wie Inhalte zu löschen
Alle Metadaten entfernen leert die sechs Felder und sonst nichts. Seiten, Text, Bilder, Links und Lesezeichen werden unverändert übernommen, weshalb die Ausgabe weiterhin sicher zu drucken oder zu signieren ist. Wenn ein Signaturbild, ein Briefkopf oder eine Fußzeile mit einem Namen auf der Seite sichtbar ist, entfernt das Löschen der Eigenschaften sie nicht. Sichtbaren Inhalt zu entfernen ist eine andere Aufgabe, die auf den Seiten selbst erledigt wird.
Wann du Metadaten behalten statt entfernen solltest
Metadaten zu entfernen ist nicht immer der richtige Schritt. Ein Publishing-Workflow, ein Dokumentenmanagementsystem und ein Aktenarchiv setzen alle auf Titel und Schlüsselwörter, um Dateien abzulegen und zu finden, und sie zu entfernen macht ein Dokument schwerer verwaltbar. Dasselbe gilt für unterzeichnete Aufzeichnungen, bei denen Ersteller und Produzent helfen, die Herkunft zu belegen.
Die vernünftige Regel ist, sich am Publikum auszurichten. Für eine Datei, die an einen Kunden, ein öffentliches Portal oder eine Bewerbung geht, korrigiere oder lösche die identifizierenden Felder. Für eine Datei, die in dein eigenes Archiv geht, oder eine, bei der die Autorendetails Teil der Aufzeichnung sind, lass sie stehen. Das Tool lässt dich ein Feld statt aller sechs ändern, du kannst also die nützlichen Werte behalten und nur die sensiblen entfernen.
Bearbeitung im Browser gegenüber dem Hochladen einer Datei
Die meisten Metadaten-Editoren sind Server-Anwendungen: Du lädst das Dokument hoch, ihre Maschine schreibt es neu und du lädst das Ergebnis herunter. Das funktioniert, aber gerade bei den Dateien, die Menschen am meisten bereinigen wollen, Verträge, Bewerbungen, Krankenakten und Ausweisscans, ist das Übergeben des Originals an einen Dritten genau das Risiko, das du reduzieren wolltest.
| Ansatz | Wohin die Datei geht | Worauf du verzichtest |
|---|---|---|
| Aihangsoft PDF-Metadaten | Bleibt auf deinem Gerät | Nichts. Kein Konto, kein Upload, kein Wasserzeichen |
| Ein typischer Server-Editor | Auf deren Server hochgeladen | Aufbewahrungs- und Datenschutzrichtlinien, denen du vertrauen musst |
Eine lokale Bearbeitung bedeutet außerdem, dass die Datei ab dem Moment, in dem die Seite geladen ist, keine Verbindung braucht. Du kannst einen Stapel Dokumente in einem Zug ohne Signal bereinigen, und die Originale auf der Festplatte werden nie verändert, ein Durchlauf, bei dem du unsicher bist, kostet dich also nichts.