Vom Scan zum geschützten PDF: ein privater Workflow in vier Schritten

Ein Scan-zu-PDF-Workflow hat vier Schritte: Verwandle die Bilder in ein PDF, extrahiere den Text, damit er durchsuchbar wird, ordne die Seitenreihenfolge und -drehung und sperre die Datei dann mit einem Passwort. Jeder dieser Schritte kann im Browser laufen, ein sensibles Dokument muss also nie die Maschine verlassen, auf der es gescannt wurde.

Der Wert, alles an einem Ort zu erledigen, ist, dass unterwegs nichts einem Fremden ausgehändigt wird. Ein gescannter Pass, ein unterschriebener Vertrag oder ein medizinisches Formular ist genau die Datei, die Cloud-Konverter so lange behalten, wie ihre Richtlinie erlaubt, und es ist genau die Datei, die du nicht hochladen solltest. Dieser Workflow verwendet vier separate Browser-Tools, und die Datei wandert zwischen ihnen über deinen eigenen Downloads-Ordner statt über einen Server. Jeder Schritt unten sagt, was er tut, was einzustellen ist und wo das Tool aufhört zu arbeiten, damit du entscheiden kannst, wie weit du gehst.

Die meisten lösen das mit einer Scanner-App, die in ein Cloud-Laufwerk hochlädt, oder einer Konverter-Seite, die nach einem Hin und Her ein PDF zurückgibt. Beide funktionieren, bis das Dokument eines ist, das du nicht irgendwohin senden darfst: eine unterschriebene Vereinbarung, ein Leistungsbescheid, eine Seite mit medizinischen Ergebnissen. Die vier Schritte unten erledigen dieselbe Aufgabe, wobei die Datei nie dein Gerät verlässt.

Bild zu PDF

Schritt eins des Workflows. Kombiniere JPG-, PNG-, WebP-, AVIF-, GIF- und BMP-Scans zu einem PDF, mit Seitengröße, Ausrichtung und Rändern unter deiner Kontrolle.

Bild zu PDF öffnen

Warum den ganzen Workflow auf deiner Maschine halten

Der Grund, sich darum zu kümmern, ist nicht abstrakt. Ein Cloud-Konverter muss deine Datei empfangen, sie für einen gewissen Zeitraum behalten und entscheiden, wann er sie löscht. Bei einer Nebenkostenabrechnung ist das ein Schulterzucken; bei einem Ausweis, einem Vertrag oder einer Krankenakte ist es eine Kopie, die du nie erzeugen wolltest.

Dieser WorkflowUpload-basierter Konverter
Wohin der Scan gehtBleibt auf deinem GerätAn deren Server gesendet
Wie die Datei zwischen den Schritten wandertDein Downloads-OrdnerIhr Sitzungsspeicher
AufbewahrungDu entscheidestIhre Richtlinie
KontoNicht nötigOft erforderlich
Funktioniert offlineNach dem ersten Laden der EngineNein

Alles unten setzt ein aktuelles Chrome, Edge, Firefox oder Safari voraus, da der Workflow die modernen Canvas-, WebAssembly- und File-APIs benötigt. Die Engines werden einmal heruntergeladen und zwischengespeichert, ein zweiter Durchlauf eines Schritts ist also schneller.

Schritt 1: Verwandle die Scans in ein PDF

Die Bild zu PDF Tool nimmt JPG-, PNG-, WebP-, AVIF-, GIF- und BMP-Dateien und schreibt ein PDF mit einer Seite pro Bild. JPG und PNG werden so eingebettet, wie sie sind; die anderen Formate werden zuerst über ein Canvas dekodiert, was sie ohne Server funktionsfähig hält.

  1. Füge die Seitenbilder hinzu. Ziehe die Scans in der Reihenfolge hinein, in der du sie hast. Ziehe die Karten oder verwende die Auf- und Ab-Pfeile auf jeder Karte, um die Reihenfolge vor dem Export zu korrigieren.
  2. Lege die Seitengeometrie fest. Wähle A4 oder Letter, dann Auto, Hochformat oder Querformat und einen Rand von Kein, Klein, Mittel oder Groß. Wähle Contain, um den ganzen Scan innerhalb des Rands einzupassen, oder Cover, um die Seite zu füllen und den Leser den Überhang beschneiden zu lassen.
  3. Benenne die Datei und baue sie. Das Tool meldet die kombinierte Quellgröße und die fertige PDF-Größe, damit du sehen kannst, ob das Einbetten der Scans etwas Vernünftiges ergeben hat, bevor du herunterlädst.

Einstellungen, die für einen Scan wichtig sind

Verwende Contain für Dokumente, weil es garantiert, dass die ganze Seite sichtbar ist und nie eine Unterschrift oder einen Stempel abschneidet. Cover ist für fotoartige Scans, bei denen die Ränder keine Information tragen. Ein Rand von Mittel oder Groß gibt einer Seite einen druckbaren Rahmen und wirkt beabsichtigt; Kein passt zu einem Scan, den du nur am Bildschirm ansehen willst. Wenn eine Seite seitlich ankommt, lass sie und korrigiere die Ausrichtung in Schritt drei, wo die Drehung nichts neu codiert.

Schritt 2: Mache den Text durchsuchbar

Die PDF zu Text Tool verwendet eine zweistufige Strategie, die selbst entscheidet. Es fragt zuerst jede Seite nach ihrer Textebene, was für alles, was von einem Textverarbeitungsprogramm, einem Browser oder einem Design-Tool exportiert wurde, sofort und exakt ist. Nur für Seiten, die fast keinen echten Text haben, also wirklich nur ein Bild einer Seite sind, rendert es die Seite in doppelter Auflösung und führt OCR darauf aus.

Was das Tool tatsächlich liefert

Sei klar über die Ausgabe, bevor du dich darauf verlässt. Das Tool gibt die Wörter selbst zurück, als Text, den du kopieren oder als reine Textdatei herunterladen kannst. Es schreibt keine unsichtbare OCR-Ebene zurück in das PDF, das PDF selbst wird also nach diesem Schritt in einem Reader nicht durchsuchbar. Was du bekommst, ist eine durchsuchbare, zitierfähige Kopie des Dokumenttexts neben dem PDF, was die meisten Archivierungs- und Zitieraufgaben tatsächlich brauchen.

  1. PDF hinzufügen. Ziehe die Datei hinein, die du in Schritt eins gebaut hast. Wenn das PDF nach einem Passwort fragt, entsperre es zuerst mit dem PDF entsperren Tool, weil dieser Reader keine gesperrte Datei öffnen kann.
  2. Wähle die OCR-Sprache, wenn du sie brauchst. Die Wahl betrifft nur gescannte Seiten; eine Seite mit einer echten Textebene wird so gelesen, wie sie ist, egal in welcher Sprache. Englisch läuft aus lokalen Daten, andere Sprachen werden einmal heruntergeladen und zwischengespeichert.
  3. Führe es aus und lies die Zusammenfassung. Das Ergebnis meldet, wie viele Seiten aus einer Textebene kamen und wie viele eine Erkennung brauchten, damit du weißt, welcher Teil der Ausgabe ein Korrekturlesen verdient, bevor du ihm vertraust.

Die Erkennung ist gut bei sauberen, geraden Scans in vernünftiger Auflösung und deutlich schlechter bei schiefen, schwachen oder handschriftlichen Seiten. Behandle OCR-Ausgaben als einen Entwurf, den du prüfst, nicht als ein Transkript, das du ungelesen ablegen kannst.

Schritt 3: Bringe die Seiten in die richtige Reihenfolge

Die PDF organisieren Tool rendert eine Miniaturansicht für jede Seite und lässt dich das Dokument vor dem Export neu aufbauen. Hier werden die Korrekturen erledigt, die Schritt eins nicht machen kann, wie eine seitliche Seite oder ein zweimal gescannter Bogen, ohne den Originalscan erneut anzufassen.

  • Neu anordnen indem du eine Miniaturansicht ziehst oder die linken und rechten Pfeile für Tastatur- und Touch-Nutzung verwendest.
  • Drehen eine einzelne Seite oder eine ganze Auswahl jeweils um 90 Grad. Die Drehung wird als Seitengeometrie gespeichert, das Bild wird also nicht neu codiert.
  • Löschen leere oder doppelte Seiten, mit einer Rückgängig-Schaltfläche, die durch deine letzten Änderungen zurückgeht, wenn versehentlich eine Seite verschwindet.
  • Seitenzahlen hinzufügen wenn du sie willst, wobei du die Startnummer wählst und ob sie unten rechts, oben rechts oder mittig am Fuß der Seite sitzen.

Zahlen werden in einer Standard-Helvetica gezeichnet, sie rendern also überall gleich. Das Tool schreibt eine neue Datei, statt an Ort und Stelle zu bearbeiten, dein Original-PDF bleibt also unangetastet und ein Fehler hier kostet nur einen erneuten Durchlauf.

Schritt 4: Sperre es mit einem Passwort

Die PDF schützen Tool verschlüsselt das fertige Dokument mit AES-256 im Browser, mit einer WebAssembly-Version von qpdf. Die Verschlüsselung geschieht lokal, das Passwort und die Datei reisen also nie zusammen über ein Netzwerk, was genau der Fehlermodus ist, den du vermeiden willst.

Öffnungspasswort versus Besitzerpasswort

Es gibt zwei Passwörter, und sie erfüllen unterschiedliche Aufgaben. Das Benutzerpasswort ist das, das jeder eingeben muss, um das Dokument überhaupt zu öffnen. Das Besitzerpasswort steuert die Berechtigungen, die mit der Datei reisen. Wenn du das Besitzerpasswort leer lässt, ist es standardmäßig derselbe Wert wie das Benutzerpasswort, was für ein persönliches Archiv in Ordnung und für ein Dokument, das du verteilst, weniger flexibel ist.

  1. Füge das PDF hinzu und lege das Benutzerpasswort fest. Vier Zeichen ist das Minimum, das das Tool akzeptiert, und es prüft, dass das Bestätigungsfeld übereinstimmt, bevor es startet.
  2. Lege das Besitzerpasswort und die Berechtigungen fest. Entscheide separat, ob Drucken erlaubt ist, ob Text kopiert werden kann und ob das Dokument geändert werden kann.
  3. Verschlüsseln und herunterladen. Das Ergebnis wird mit einem Suffix protected geschrieben, damit es das Original nicht überschreibt. Bewahre eine unverschlüsselte Kopie an einem sicheren Ort auf, weil ein vergessenes Passwort bei einer AES-256-Datei hier nicht wiederherstellbar ist.

Zwei Limits gelten. Dateien über 50 MB werden abgelehnt, teile also einen sehr großen Scan zuerst. Ein Dokument, das bereits passwortgeschützt ist, muss entsperrt werden, bevor es erneut verschlüsselt werden kann.

Zwei optionale Schritte

Keines von beiden ist erforderlich, und beide sind es wert, gekannt zu werden, weil ihre Grenzen leicht missverstanden werden.

Verkleinere zuerst einen aufgeblähten Scan

Die PDF komprimieren Tool ist eine verlustfreie strukturelle Neuschreibung: Es packt Objekte in Streams, komprimiert die Streams, die es kann, neu und baut die Querverweistabelle neu auf. Was es nicht tut, ist, die Bilder in einem Scan neu zu codieren, eine Datei, deren Größe größtenteils aus Bildern besteht, wird also nicht viel kleiner. Bei einem kleinen, bereits dichten PDF kann die Ausgabe sogar wachsen, weil der Objekt-Stream und die Linearisierung eigenen Overhead mitbringen. Das Tool sagt das ehrlich, wenn es passiert. Führe es vor Schritt vier aus, damit du die Größen vergleichen kannst, während die Datei noch entsperrt ist.

Versehe die Bilder mit einem Wasserzeichen, bevor du das PDF baust

Wenn eine Entwurfskopie markiert werden muss, füge mit dem das Wasserzeichen zu den Seitenbildern hinzu Bild-Wasserzeichen Tool vor Schritt eins. Es unterstützt Text-Wasserzeichen mit Position, Größe, Farbe, Deckkraft, Drehung und einem gekachelten Modus und kann einen Stapel Bilder in einem Durchgang verarbeiten. Zwei Limits sind wichtig: Es platziert Text, kein Bild und kein Logo, und der Schriftstapel ist lateinisch, Schriften außerhalb des lateinischen Bereichs werden also möglicherweise nicht wie erwartet dargestellt. Führe das Wasserzeichnen an den losen Bildern durch, weil die PDF-Tools hier einem fertigen Dokument kein Text- oder Bild-Overlay hinzufügen.

Wo dieser Workflow endet

Dies ist ein privater Browser-Workflow, kein Dokumentenmanagementsystem, und ein paar Aufgaben fallen außerhalb davon.

  • Keine durchsuchbare PDF-Ausgabe. Schritt zwei gibt dir durchsuchbaren Text als Begleitdatei. Wenn ein System auf einem PDF besteht, dessen eigene Textebene durchsuchbar ist, erzeugt dieser Workflow diese Datei nicht.
  • OCR ist nur so gut wie der Scan. Handschrift, schiefe Seiten, Heftklammern und kontrastarme Fotokopien erzeugen Fehler. Saubere, gerade 300-dpi-Scans sind der Bereich, in dem die Erkennung gut funktioniert.
  • Komprimierung ist keine Bildkomprimierung. Der PDF-Kompressor kann einen bildlastigen Scan nicht verkleinern. Erneutes Scannen mit niedrigerer Auflösung oder Komprimieren der Bilder vor Schritt eins ist der Weg, diese Art von Größe zu reduzieren.
  • Die Verschlüsselung hat eine Größengrenze. Die Tools Schützen und Komprimieren enden beide bei 50 MB, ein sehr großer Scan muss also zuerst geteilt werden.
  • Ein Dokument nach dem anderen. Jeder Schritt arbeitet an einer einzelnen Datei, ein Stapel separater Dokumente ist also eine Reihe von Durchläufen statt ein Auftrag.
  • Engines werden bei der ersten Nutzung heruntergeladen. Die PDF- und OCR-Engines sind ein paar Megabyte groß, einmal abgerufen und zwischengespeichert. Das ist der Preis dafür, die Arbeit auf deiner Maschine zu erledigen.

Häufig gestellte Fragen

Verwandle die Scans zuerst in ein PDF und arbeite dann am PDF statt an losen Bildern, weil jeder spätere Schritt ein einzelnes Dokument voraussetzt. Verwende ein Tool Bild zu PDF, das JPG, PNG, WebP, AVIF, GIF und BMP nimmt, damit Handyfotos und Flachbettscans in einem Durchlauf gemischt werden können. Stelle die Seitengröße auf A4 oder Letter, wähle, ob das Bild innerhalb des Rands enthalten ist oder die ganze Seite bedeckt, und bringe die Seiten vor dem Export in die gewünschte Reihenfolge. Es im Browser zu tun, hält den Scan auf deinem Gerät, was für Verträge, Ausweise und medizinische Unterlagen wichtig ist. Die Ausgabe ist ein normales PDF, das jeder Reader öffnen kann, und du kannst es vor dem Herunterladen benennen. Wenn eine Seite im Querformat herauskommt, obwohl sie im Hochformat sein sollte, korrigiere sie im Organisieren-Schritt statt neu zu scannen, da die Drehung dort verlustfrei ist.
Ja, mit einem ehrlichen Vorbehalt dazu, was durchsuchbar hier bedeutet. Das Tool PDF zu Text liest Seiten, die bereits echten Text enthalten, direkt und führt OCR auf Seiten aus, die nur ein Bild einer Seite sind, alles im Browser. Was es erzeugt, ist jedoch der extrahierte Text selbst, als reine Textdatei, die du kopieren oder herunterladen kannst. Es schreibt keine unsichtbare OCR-Textebene zurück in das PDF, das Original-PDF wird also nach diesem Schritt in einem Reader nicht durchsuchbar. Was du bekommst, ist eine durchsuchbare, zitierfähige Kopie der Wörter neben dem PDF, was die meisten tatsächlich für Archivierung, Zitieren oder die Einspeisung in ein anderes System brauchen. Beide Dateien bleiben auf deiner Maschine, und die Zusammenfassung zeigt, wie viele Seiten aus einer Textebene kamen und wie viele OCR brauchten.
Öffne das Tool PDF schützen, ziehe die Datei hinein und lege zwei Passwörter fest: das Benutzerpasswort, das jeder eingeben muss, um das Dokument zu öffnen, und ein Besitzerpasswort, das die Berechtigungen steuert. Wähle, ob Drucken, Textkopieren und Bearbeiten erlaubt sind, und verschlüssele dann. Die Ausgabe wird mit AES-256 verschlüsselt, der einzigen Stärke, die die Engine schreiben wird, und die Datei wird mit einem Suffix protected heruntergeladen. Zwei Limits sind im Voraus zu wissen. Ein Dokument über 50 MB wird abgelehnt, teile also einen großen Scan zuerst, und eine Datei, die bereits passwortgeschützt ist, muss entsperrt werden, bevor sie erneut verschlüsselt werden kann. Während all dessen wird nichts hochgeladen, was bei Dokumenten, die per Definition sensibel sind, der springende Punkt ist. Bewahre das Besitzerpasswort irgendwo auf, wo du es findest, weil die Berechtigungen ohne es nicht geändert werden können.
Komprimiere, bevor du schützt, und nur, wenn die Datei durch lose Struktur wirklich aufgebläht ist. Das Tool PDF komprimieren ist eine verlustfreie strukturelle Neuschreibung: Es packt Objekt-Streams und baut die Querverweistabelle neu auf, aber es codiert die Bilder in einem Scan nicht neu, eine stark gescannte Datei wird also nicht viel kleiner. Bei einem kleinen, bereits dichten PDF kann die Ausgabe sogar größer sein, weil der Objekt-Stream und die Linearisierung eigenen Overhead hinzufügen, und ein gemessenes Beispiel machte aus einer 1.295-Byte-Datei mit drei Seiten 2.568 Bytes. Führe es aus, bevor die Datei gesperrt wird, damit du die Größen vergleichen und das Original behalten kannst, wenn das Ergebnis größer ist. Sobald die Datei verschlüsselt ist, können die Komprimierungs- und OCR-Tools sie nicht lesen, bis sie wieder entsperrt ist. Wenn Größe wichtiger ist als Wiedergabetreue, komprimiere stattdessen die Seitenbilder vor Schritt eins.
Ja, vorausgesetzt, jeder Schritt läuft lokal und du prüfst, dass er es tut. Alle vier Tools in diesem Workflow laufen im Browser: Bilder werden mit pdf-lib zu einem PDF zusammengesetzt, Text wird mit PDF.js gelesen, Seiten werden lokal neu aufgebaut, und die Verschlüsselung verwendet eine WebAssembly-Version von qpdf. Die Datei wandert zwischen den Tools über deinen eigenen Downloads-Ordner, nicht über einen Server, es wird also zu keinem Zeitpunkt etwas übertragen. Du kannst es selbst überprüfen, indem du die Entwicklertools des Browsers öffnest, zum Netzwerk-Panel wechselst und beobachtest, dass keine Anfrage dein Dokument überträgt, während ein Schritt läuft. Die erste Nutzung einiger Tools lädt ihre Engine herunter, das ist Code und nicht deine Datei. Das ist der Unterschied zwischen einem privaten Workflow und einem Cloud-Konverter, der den Scan auf einem Server speichert. Wenn ein Schritt dich jemals bittet, das Dokument hochzuladen, stoppe und verwende ein Tool, das das nicht tut.

Ein Dokument digitalisieren, ohne es irgendwohin zu senden

Kostenlos, privat und unbegrenzt. Kein Konto nötig.

Beginne mit Bild zu PDF