PDF in Text
Wähle die Seiten, und der Text kommt als .txt-Datei heraus: als Absätze, die sich im Editor neu umbrechen, oder Zeile für Zeile, wie er auf der Seite steht. Ein Scan, der durch OCR gelaufen ist, wird wie jede andere Datei extrahiert; einer ohne hat keinen Text herzugeben. Alles läuft in deinem Browser - die Datei verlässt nie dein Gerät.
PDF-Dateien hier ablegen
Zieh sie einfach vom Desktop hierher
- Nur PDF-Dateien
- Bis zu 15 MB pro Datei
- 2 Dateien pro Durchgang - unbegrenzt mit Pro
Der Text kommt in Lesereihenfolge heraus, so wie eine Suche ihn sieht - ein per OCR erkannter Scan eingeschlossen.
Häufige Fragen
Was kommt dabei heraus?
Eine einfache .txt-Datei pro PDF mit dem Text der gewählten Seiten in Lesereihenfolge - als Absätze, die sich im Editor neu umbrechen, oder Zeile für Zeile, wie er auf der Seite steht -, wahlweise mit einer Überschrift oder Leerzeile zwischen den Seiten. Alles läuft in deinem Browser; die Datei wird nie hochgeladen.
Funktioniert es mit gescannten PDFs?
Nur wenn der Scan eine Textebene hat. Ein Scan, der durch das OCR-Tool gelaufen ist, wird wie jede andere Datei extrahiert - der unsichtbare Text wird gelesen. Ein Scan ohne Textebene hat keinen Text herzugeben; die Dateiliste sagt es und verweist auf OCR.
Warum kommen manche Zeilen in seltsamer Reihenfolge heraus?
Der Text wird Zeile für Zeile von oben nach unten gelesen, danach, wo jede Zeile auf der Seite steht. Eine Seite mit Spalten oder Kästen kann sich dabei verzahnen; stell das Layout auf Zeilen, um jede Zeile so zu sehen, wie sie ist, oder grenze die Seiten ein.
Was ist mit Tabellen und Formularen?
Wähle Zeilen: Jede Zeile bleibt eine eigene Zeile, mit einem Leerzeichen, wo die Seite eine Lücke lässt, sodass die Zeilen einer Tabelle Zeilen bleiben. Der Absatzmodus ist für Fließtext - er verbindet die Zeilen eines Blocks und flickt Silbentrennungen.
Kommt Formatierung mit?
Nein - eine .txt-Datei enthält Zeichen und Zeilenumbrüche, sonst nichts: keine Schriften, kein Fett, keine Farben, keine Bilder, keine Spalten. Genau das ist der Sinn, wenn du den Text durchsuchen, zitieren oder an ein anderes Programm geben willst. Soll das Dokument wie ein Dokument aussehen, wandle es stattdessen in Word um.
Wie lange dauert ein großes Dokument?
Bei den meisten Dokumenten Sekunden, wobei es von der Datei und deinem Computer abhängt - die Arbeit passiert auf deinem Rechner. Der Text wird schon beim Laden der Datei gelesen, sodass Wortzahl in der Liste und Vorschau bereitstehen, bevor du etwas drückst.
Fehlt dir etwas, oder hat dich das Ergebnis überrascht?
Verwandte Tools
- OCR - PDF durchsuchbar machenDen Text eines gescannten PDFs im Browser erkennen und eine durchsuchbare, auswählbare Textebene hinzufügen - der Scan selbst bleibt unberührt
- PDF in WordEin PDF in ein bearbeitbares Word-Dokument (.docx) umwandeln, das das Layout behält
- PDF in ExcelDie Tabellen eines PDFs in eine Excel-Arbeitsmappe (.xlsx) umwandeln, Zahlen als Zahlen
- Seiten extrahierenAusgewählte Seiten aus einem oder mehreren PDFs extrahieren