Ein Scan-zu-PDF-Workflow hat vier Schritte: Verwandle die Bilder in ein PDF, extrahiere den Text, damit er durchsuchbar wird, ordne die Seitenreihenfolge und -drehung und sperre die Datei dann mit einem Passwort. Jeder dieser Schritte kann im Browser laufen, ein sensibles Dokument muss also nie die Maschine verlassen, auf der es gescannt wurde.
Der Wert, alles an einem Ort zu erledigen, ist, dass unterwegs nichts einem Fremden ausgehändigt wird. Ein gescannter Pass, ein unterschriebener Vertrag oder ein medizinisches Formular ist genau die Datei, die Cloud-Konverter so lange behalten, wie ihre Richtlinie erlaubt, und es ist genau die Datei, die du nicht hochladen solltest. Dieser Workflow verwendet vier separate Browser-Tools, und die Datei wandert zwischen ihnen über deinen eigenen Downloads-Ordner statt über einen Server. Jeder Schritt unten sagt, was er tut, was einzustellen ist und wo das Tool aufhört zu arbeiten, damit du entscheiden kannst, wie weit du gehst.
Die meisten lösen das mit einer Scanner-App, die in ein Cloud-Laufwerk hochlädt, oder einer Konverter-Seite, die nach einem Hin und Her ein PDF zurückgibt. Beide funktionieren, bis das Dokument eines ist, das du nicht irgendwohin senden darfst: eine unterschriebene Vereinbarung, ein Leistungsbescheid, eine Seite mit medizinischen Ergebnissen. Die vier Schritte unten erledigen dieselbe Aufgabe, wobei die Datei nie dein Gerät verlässt.
Bild zu PDF
Schritt eins des Workflows. Kombiniere JPG-, PNG-, WebP-, AVIF-, GIF- und BMP-Scans zu einem PDF, mit Seitengröße, Ausrichtung und Rändern unter deiner Kontrolle.
Warum den ganzen Workflow auf deiner Maschine halten
Der Grund, sich darum zu kümmern, ist nicht abstrakt. Ein Cloud-Konverter muss deine Datei empfangen, sie für einen gewissen Zeitraum behalten und entscheiden, wann er sie löscht. Bei einer Nebenkostenabrechnung ist das ein Schulterzucken; bei einem Ausweis, einem Vertrag oder einer Krankenakte ist es eine Kopie, die du nie erzeugen wolltest.
| Dieser Workflow | Upload-basierter Konverter | |
|---|---|---|
| Wohin der Scan geht | Bleibt auf deinem Gerät | An deren Server gesendet |
| Wie die Datei zwischen den Schritten wandert | Dein Downloads-Ordner | Ihr Sitzungsspeicher |
| Aufbewahrung | Du entscheidest | Ihre Richtlinie |
| Konto | Nicht nötig | Oft erforderlich |
| Funktioniert offline | Nach dem ersten Laden der Engine | Nein |
Alles unten setzt ein aktuelles Chrome, Edge, Firefox oder Safari voraus, da der Workflow die modernen Canvas-, WebAssembly- und File-APIs benötigt. Die Engines werden einmal heruntergeladen und zwischengespeichert, ein zweiter Durchlauf eines Schritts ist also schneller.
Schritt 1: Verwandle die Scans in ein PDF
Die Bild zu PDF Tool nimmt JPG-, PNG-, WebP-, AVIF-, GIF- und BMP-Dateien und schreibt ein PDF mit einer Seite pro Bild. JPG und PNG werden so eingebettet, wie sie sind; die anderen Formate werden zuerst über ein Canvas dekodiert, was sie ohne Server funktionsfähig hält.
- Füge die Seitenbilder hinzu. Ziehe die Scans in der Reihenfolge hinein, in der du sie hast. Ziehe die Karten oder verwende die Auf- und Ab-Pfeile auf jeder Karte, um die Reihenfolge vor dem Export zu korrigieren.
- Lege die Seitengeometrie fest. Wähle A4 oder Letter, dann Auto, Hochformat oder Querformat und einen Rand von Kein, Klein, Mittel oder Groß. Wähle Contain, um den ganzen Scan innerhalb des Rands einzupassen, oder Cover, um die Seite zu füllen und den Leser den Überhang beschneiden zu lassen.
- Benenne die Datei und baue sie. Das Tool meldet die kombinierte Quellgröße und die fertige PDF-Größe, damit du sehen kannst, ob das Einbetten der Scans etwas Vernünftiges ergeben hat, bevor du herunterlädst.
Einstellungen, die für einen Scan wichtig sind
Verwende Contain für Dokumente, weil es garantiert, dass die ganze Seite sichtbar ist und nie eine Unterschrift oder einen Stempel abschneidet. Cover ist für fotoartige Scans, bei denen die Ränder keine Information tragen. Ein Rand von Mittel oder Groß gibt einer Seite einen druckbaren Rahmen und wirkt beabsichtigt; Kein passt zu einem Scan, den du nur am Bildschirm ansehen willst. Wenn eine Seite seitlich ankommt, lass sie und korrigiere die Ausrichtung in Schritt drei, wo die Drehung nichts neu codiert.
Schritt 2: Mache den Text durchsuchbar
Die PDF zu Text Tool verwendet eine zweistufige Strategie, die selbst entscheidet. Es fragt zuerst jede Seite nach ihrer Textebene, was für alles, was von einem Textverarbeitungsprogramm, einem Browser oder einem Design-Tool exportiert wurde, sofort und exakt ist. Nur für Seiten, die fast keinen echten Text haben, also wirklich nur ein Bild einer Seite sind, rendert es die Seite in doppelter Auflösung und führt OCR darauf aus.
Was das Tool tatsächlich liefert
Sei klar über die Ausgabe, bevor du dich darauf verlässt. Das Tool gibt die Wörter selbst zurück, als Text, den du kopieren oder als reine Textdatei herunterladen kannst. Es schreibt keine unsichtbare OCR-Ebene zurück in das PDF, das PDF selbst wird also nach diesem Schritt in einem Reader nicht durchsuchbar. Was du bekommst, ist eine durchsuchbare, zitierfähige Kopie des Dokumenttexts neben dem PDF, was die meisten Archivierungs- und Zitieraufgaben tatsächlich brauchen.
- PDF hinzufügen. Ziehe die Datei hinein, die du in Schritt eins gebaut hast. Wenn das PDF nach einem Passwort fragt, entsperre es zuerst mit dem PDF entsperren Tool, weil dieser Reader keine gesperrte Datei öffnen kann.
- Wähle die OCR-Sprache, wenn du sie brauchst. Die Wahl betrifft nur gescannte Seiten; eine Seite mit einer echten Textebene wird so gelesen, wie sie ist, egal in welcher Sprache. Englisch läuft aus lokalen Daten, andere Sprachen werden einmal heruntergeladen und zwischengespeichert.
- Führe es aus und lies die Zusammenfassung. Das Ergebnis meldet, wie viele Seiten aus einer Textebene kamen und wie viele eine Erkennung brauchten, damit du weißt, welcher Teil der Ausgabe ein Korrekturlesen verdient, bevor du ihm vertraust.
Die Erkennung ist gut bei sauberen, geraden Scans in vernünftiger Auflösung und deutlich schlechter bei schiefen, schwachen oder handschriftlichen Seiten. Behandle OCR-Ausgaben als einen Entwurf, den du prüfst, nicht als ein Transkript, das du ungelesen ablegen kannst.
Schritt 3: Bringe die Seiten in die richtige Reihenfolge
Die PDF organisieren Tool rendert eine Miniaturansicht für jede Seite und lässt dich das Dokument vor dem Export neu aufbauen. Hier werden die Korrekturen erledigt, die Schritt eins nicht machen kann, wie eine seitliche Seite oder ein zweimal gescannter Bogen, ohne den Originalscan erneut anzufassen.
- Neu anordnen indem du eine Miniaturansicht ziehst oder die linken und rechten Pfeile für Tastatur- und Touch-Nutzung verwendest.
- Drehen eine einzelne Seite oder eine ganze Auswahl jeweils um 90 Grad. Die Drehung wird als Seitengeometrie gespeichert, das Bild wird also nicht neu codiert.
- Löschen leere oder doppelte Seiten, mit einer Rückgängig-Schaltfläche, die durch deine letzten Änderungen zurückgeht, wenn versehentlich eine Seite verschwindet.
- Seitenzahlen hinzufügen wenn du sie willst, wobei du die Startnummer wählst und ob sie unten rechts, oben rechts oder mittig am Fuß der Seite sitzen.
Zahlen werden in einer Standard-Helvetica gezeichnet, sie rendern also überall gleich. Das Tool schreibt eine neue Datei, statt an Ort und Stelle zu bearbeiten, dein Original-PDF bleibt also unangetastet und ein Fehler hier kostet nur einen erneuten Durchlauf.
Schritt 4: Sperre es mit einem Passwort
Die PDF schützen Tool verschlüsselt das fertige Dokument mit AES-256 im Browser, mit einer WebAssembly-Version von qpdf. Die Verschlüsselung geschieht lokal, das Passwort und die Datei reisen also nie zusammen über ein Netzwerk, was genau der Fehlermodus ist, den du vermeiden willst.
Öffnungspasswort versus Besitzerpasswort
Es gibt zwei Passwörter, und sie erfüllen unterschiedliche Aufgaben. Das Benutzerpasswort ist das, das jeder eingeben muss, um das Dokument überhaupt zu öffnen. Das Besitzerpasswort steuert die Berechtigungen, die mit der Datei reisen. Wenn du das Besitzerpasswort leer lässt, ist es standardmäßig derselbe Wert wie das Benutzerpasswort, was für ein persönliches Archiv in Ordnung und für ein Dokument, das du verteilst, weniger flexibel ist.
- Füge das PDF hinzu und lege das Benutzerpasswort fest. Vier Zeichen ist das Minimum, das das Tool akzeptiert, und es prüft, dass das Bestätigungsfeld übereinstimmt, bevor es startet.
- Lege das Besitzerpasswort und die Berechtigungen fest. Entscheide separat, ob Drucken erlaubt ist, ob Text kopiert werden kann und ob das Dokument geändert werden kann.
- Verschlüsseln und herunterladen. Das Ergebnis wird mit einem Suffix protected geschrieben, damit es das Original nicht überschreibt. Bewahre eine unverschlüsselte Kopie an einem sicheren Ort auf, weil ein vergessenes Passwort bei einer AES-256-Datei hier nicht wiederherstellbar ist.
Zwei Limits gelten. Dateien über 50 MB werden abgelehnt, teile also einen sehr großen Scan zuerst. Ein Dokument, das bereits passwortgeschützt ist, muss entsperrt werden, bevor es erneut verschlüsselt werden kann.
Zwei optionale Schritte
Keines von beiden ist erforderlich, und beide sind es wert, gekannt zu werden, weil ihre Grenzen leicht missverstanden werden.
Verkleinere zuerst einen aufgeblähten Scan
Die PDF komprimieren Tool ist eine verlustfreie strukturelle Neuschreibung: Es packt Objekte in Streams, komprimiert die Streams, die es kann, neu und baut die Querverweistabelle neu auf. Was es nicht tut, ist, die Bilder in einem Scan neu zu codieren, eine Datei, deren Größe größtenteils aus Bildern besteht, wird also nicht viel kleiner. Bei einem kleinen, bereits dichten PDF kann die Ausgabe sogar wachsen, weil der Objekt-Stream und die Linearisierung eigenen Overhead mitbringen. Das Tool sagt das ehrlich, wenn es passiert. Führe es vor Schritt vier aus, damit du die Größen vergleichen kannst, während die Datei noch entsperrt ist.
Versehe die Bilder mit einem Wasserzeichen, bevor du das PDF baust
Wenn eine Entwurfskopie markiert werden muss, füge mit dem das Wasserzeichen zu den Seitenbildern hinzu Bild-Wasserzeichen Tool vor Schritt eins. Es unterstützt Text-Wasserzeichen mit Position, Größe, Farbe, Deckkraft, Drehung und einem gekachelten Modus und kann einen Stapel Bilder in einem Durchgang verarbeiten. Zwei Limits sind wichtig: Es platziert Text, kein Bild und kein Logo, und der Schriftstapel ist lateinisch, Schriften außerhalb des lateinischen Bereichs werden also möglicherweise nicht wie erwartet dargestellt. Führe das Wasserzeichnen an den losen Bildern durch, weil die PDF-Tools hier einem fertigen Dokument kein Text- oder Bild-Overlay hinzufügen.
Wo dieser Workflow endet
Dies ist ein privater Browser-Workflow, kein Dokumentenmanagementsystem, und ein paar Aufgaben fallen außerhalb davon.
- Keine durchsuchbare PDF-Ausgabe. Schritt zwei gibt dir durchsuchbaren Text als Begleitdatei. Wenn ein System auf einem PDF besteht, dessen eigene Textebene durchsuchbar ist, erzeugt dieser Workflow diese Datei nicht.
- OCR ist nur so gut wie der Scan. Handschrift, schiefe Seiten, Heftklammern und kontrastarme Fotokopien erzeugen Fehler. Saubere, gerade 300-dpi-Scans sind der Bereich, in dem die Erkennung gut funktioniert.
- Komprimierung ist keine Bildkomprimierung. Der PDF-Kompressor kann einen bildlastigen Scan nicht verkleinern. Erneutes Scannen mit niedrigerer Auflösung oder Komprimieren der Bilder vor Schritt eins ist der Weg, diese Art von Größe zu reduzieren.
- Die Verschlüsselung hat eine Größengrenze. Die Tools Schützen und Komprimieren enden beide bei 50 MB, ein sehr großer Scan muss also zuerst geteilt werden.
- Ein Dokument nach dem anderen. Jeder Schritt arbeitet an einer einzelnen Datei, ein Stapel separater Dokumente ist also eine Reihe von Durchläufen statt ein Auftrag.
- Engines werden bei der ersten Nutzung heruntergeladen. Die PDF- und OCR-Engines sind ein paar Megabyte groß, einmal abgerufen und zwischengespeichert. Das ist der Preis dafür, die Arbeit auf deiner Maschine zu erledigen.