PDF in Text

Den gesamten Text eines PDFs in eine reine .txt-Datei extrahieren – zum Durchsuchen, Bearbeiten oder Weiterverarbeiten mit anderen Tools. Läuft im Browser – deine Dateien werden nie hochgeladen.

oder Datei hierher ziehen

Bis zu 50 MB
  1. 1Auswählen

    Ein PDF auswählen, das markierbaren Text enthält.

  2. 2Anpassen

    Bei Bedarf die Seiten eingrenzen und festlegen, ob Seitenumbrüche markiert werden sollen.

  3. 3Herunterladen

    Auf „Text extrahieren“ klicken und die .txt-Datei herunterladen.

Alle Wörter, nichts von der Formatierung

ShyPDF liest die Textebene des PDFs und schreibt sie in eine reine .txt-Datei: Zeilenumbrüche bleiben erhalten, Seiten werden auf Wunsch markiert, alles andere fällt weg. Genau das braucht man, um ein Dokument an ein Skript, ein Übersetzungstool oder ein KI-Modell zu geben, für Wortzählungen oder zum Einfügen an Stellen, die sich mit PDF-Formatierung schwertun.

Mit Bereichen wie 1-3, 5 beschränkst du die Extraktion auf bestimmte Seiten. Dank der Seitenumbruch-Markierungen lässt sich jede Zeile leicht dorthin zurückverfolgen, wo sie herkommt.

Wenn die Ausgabe leer zurückkommt

Ein gescanntes PDF hat keine Textebene – es besteht aus Fotografien von Text –, es gibt also nichts zu extrahieren. Schick den Scan stattdessen durch „OCR PDF“; es erkennt die Wörter in den Seitenbildern und kann reinen Text direkt ausgeben. Und wenn du Struktur statt Rohtext brauchst – Absätze, Überschriften, Tabellen –, baut „PDF in Word“ ein bearbeitbares Dokument auf.

Die Extraktion läuft in deinem Browser. Verträge, medizinische Unterlagen und alles andere, was man nicht in eine beliebige Website einfügen würde, verlassen dein Gerät nie.

Häufige Fragen

Werden meine Dateien auf einen Server hochgeladen?

Nein. Alles läuft direkt in deinem Browser, deine Dateien verlassen dein Gerät also nie. Tab schließen – und nichts bleibt zurück.

Die Ausgabe ist leer oder unlesbar. Warum?

Ist sie leer, ist dein PDF vermutlich ein Scan – schick es durch „OCR PDF“, das reinen Text direkt ausgeben kann. Unlesbare Zeichen bedeuten meist, dass das PDF ungewöhnliche Schriftkodierungen verwendet; auch da kann „OCR PDF“ oft helfen, weil es stattdessen das Seitenbild liest.

Bleibt das Layout erhalten?

Zeilenumbrüche bleiben erhalten, und die Seiten werden getrennt – Spalten, Tabellen und Formatierung dagegen nicht, denn reiner Text kennt so etwas nicht. Wenn du die Struktur brauchst, nimm „PDF in Word“.