PDF zu Text

Zieh die Wörter aus einem PDF als etwas heraus, das du kopieren, zitieren und bearbeiten kannst. Seiten, die bereits Text enthalten, werden sofort gelesen, und gescannte Seiten werden mit OCR erkannt, alles in deinem Browser.

PDF hinzufügen

Nur PDF

PDF hier ablegen oder zum Durchsuchen klicken

Funktioniert mit digitalen PDFs und mit Scans von Papierseiten

PDF

Extrahierter Text

PDF hinzufügen, um zu starten

Der Text deines Dokuments erscheint hier

Gescannte Seiten durchlaufen die Erkennung, rechne also mit ein paar Sekunden pro Seite und prüfe das Ergebnis auf falsch gelesene Wörter. Digitaler Text wird wörtlich kopiert.

So extrahierst du Text aus einem PDF

PDF hinzufügen

Ziehe das Dokument hinein. Es wird lokal geöffnet und gerendert, nichts wird hochgeladen.

Die Extraktion starten

Seiten mit einer Textebene kommen sofort zurück. Gescannte Seiten werden einzeln erkannt.

Text kopieren oder herunterladen

Korrigiere, was falsch gelesen wurde, und kopiere den Text dann oder speichere ihn als .txt-Datei.

Warum Aihangsoft PDF zu Text verwenden

Sofort bei digitalen PDFs

Wenn das Dokument bereits echten Text trägt, wird er direkt herausgezogen, ohne Erkennung und ohne Raten.

Scans verlassen deine Maschine nie

Gescannte Verträge, Rechnungen und Ausweise werden lokal gerendert und gelesen, es wird also nichts Sensibles irgendwohin gesendet.

Kostenlos, kein Seitenlimit

Keine Anmeldung und keine Obergrenze für die Seitenzahl, egal ob du eine einseitige Rechnung oder einen ganzen Bericht mitbringst.

Zwei Engines hinter einem Button

Textebenen-Extraktion

Die meisten PDFs, die aus einer Textverarbeitung, einem Browser oder einem Design-Tool exportiert wurden, tragen eine echte Textebene. Dieser Text wird genau so kopiert, wie er verfasst wurde, einschließlich Satzzeichen und Akzenten.

Anwendungsfall: Berichte, Verträge, exportierte Rechnungen

OCR-Fallback für Scans

Eine Seite, die eigentlich nur ein Foto ist, wird mit doppelter Auflösung gerendert und durch die Erkennung geschickt, ein gescanntes Papierdokument wird also zu durchsuchbarem Text.

Anwendungsfall: gescannter Papierkram, alte Archive, fotografierte Seiten

Bericht pro Seite

Die Zusammenfassung sagt dir, wie viele Seiten aus einer Textebene stammten und wie viele eine Erkennung benötigten, du weißt also, welche Seiten einen zweiten Blick wert sind.

Anwendungsfall: gemischte Dokumente, halb digital und halb gescannt

Seitenmarker in der Ausgabe

Jede Seite wird mit einem Marker versehen, damit du ein Zitat auf seine Seite zurückverfolgen kannst, was bei einer langen Quelle wichtig ist.

Anwendungsfall: Recherche, Zitate, juristische Prüfung

So funktioniert es und wohin deine Datei geht

Engine
PDF.js 4.10.38 liest die bereits in der Datei vorhandene Textebene. Seiten ohne eine solche werden übergeben an Tesseract.js 7.0.0 für OCR.
Datenstandort
Alles läuft in diesem Browser-Tab. Die Datei wird nie auf einen Server hochgeladen.
Überzeuge dich selbst
Starte hier einen Auftrag und beobachte das Netzwerk-Panel des Browsers: keine Anfrage überträgt deine Datei. So prüfst du jedes Online-Tool.

FAQ zu PDF zu Text

Ja, das ist der Hauptgrund, warum es das Tool gibt. Wenn eine Seite nur ein Bild einer Seite ist, wird sie gerendert und mit OCR gelesen. Wenn das PDF bereits echten Text enthält, wird dieser direkt herausgezogen, was sowohl schneller als auch perfekt genau ist.
Die Zusammenfassung neben dem Ergebnis zeigt, wie viele Seiten aus einer vorhandenen Textebene gelesen wurden und wie viele OCR benötigten, du weißt also, welcher Teil der Ausgabe ein genaueres Korrekturlesen verdient.
Nein. Die Datei wird in deinem Browser geöffnet und gerendert. Weder das Dokument noch der extrahierte Text wird jemals an einen Server gesendet.
Jede gescannte Seite muss zu einem Bild gerendert und dann erkannt werden, was auf einem normalen Laptop ein paar Sekunden pro Seite dauert. Ein PDF mit einer echten Textebene kommt fast sofort zurück, weil keine Erkennung nötig ist.
Es kann kein Dokument öffnen, das ein Passwort verlangt. Nutze zuerst das Tool PDF entsperren mit dem Passwort, das du kennst, lade die entsperrte Kopie herunter und lies dann den Text aus dieser Datei.
Englisch ist integriert, und elf weitere Sprachen, darunter Chinesisch, Japanisch, Koreanisch, Deutsch, Französisch und Spanisch, können ausgewählt werden. Die Sprachdaten werden bei der ersten Nutzung einmalig heruntergeladen und dann zwischengespeichert.

Hol den Text aus deinem PDF

Kostenlos, privat und unbegrenzt. Kein Konto nötig.

PDF hochladen