How to Extract Text From a PDF, Even a Scanned One
Need the words out of a PDF? Learn the difference between text and scanned PDFs, four ways to copy text, and what to do when it will not select.
Read article →Holen Sie den gesamten Text aus einem PDF auf einmal heraus und speichern Sie ihn als einfache Textdatei, die Sie überall bearbeiten können.
Nützlich zum Zitieren, Übersetzen, Durchsuchen oder um ein Dokument in einen Editor einzufügen. Die Textdatei wird in UTF-8 gespeichert, Akzente und nichtlateinische Schriften werden also korrekt angezeigt.
Das Tool liest den Text, der bereits im PDF steckt. Ein gescanntes Dokument ist nur ein Bild von Text, enthält also nichts zum Extrahieren und bräuchte OCR, was dieses Tool nicht kann. Layout wie Tabellen und Spalten bleibt in reinem Text nicht erhalten.
Öffnet sich in jedem Editor auf jedem Gerät.
Akzente und nichtlateinische Schriften werden korrekt angezeigt.
Optional markieren, wo jede Seite beginnt.
Sagt Ihnen, wenn eine Datei keinen markierbaren Text hat.
Das PDF ist wahrscheinlich ein Scan oder besteht aus Bildern. Dafür braucht es OCR-Software, die die Buchstaben erkennt.
Der Text wird Zeile für Zeile extrahiert. Reiner Text kann das Tabellenlayout nicht beibehalten.
Ja, solange das PDF echten Text enthält. Die Ausgabe ist UTF-8.
Unsere Ratgeber erscheinen derzeit auf Englisch.
Need the words out of a PDF? Learn the difference between text and scanned PDFs, four ways to copy text, and what to do when it will not select.
Read article →
Not sure which DPI or color mode to pick? These scan settings keep text sharp and PDF files small, for contracts, receipts, books and photos.
Read article →Es ist kostenlos, privat und dauert nur Sekunden. Ihre Dateien verlassen nie Ihr Gerät.