Kein Upload – das PDF bleibt in deinem Browser

PDF in Text umwandeln

Den Text aus einem PDF herausholen – sauber, ohne Zeilenumbrüche mitten im Satz. Zum Kopieren oder als TXT-Datei. Scans werden per Texterkennung gelesen.

PDF hierher ziehen oder klicken und Datei auswählen PDF auswählen

Warum der kopierte Text oft kaputt ist

Ein PDF speichert Text Zeile für Zeile an festen Positionen. Kopiert man ihn direkt, steht hinter jeder Zeile ein Umbruch und getrennte Wörter bleiben getrennt.

Dieses Tool erkennt Absätze, verbindet die Zeilen wieder und fügt „Silben-
trennung“ zusammen. Listen bleiben Listen.

Gescannte PDFs

Ein Scan ist nur ein Bild – es gibt keinen Text zum Herauskopieren. Für solche Seiten bietet das Tool eine Texterkennung (OCR) für Deutsch und Englisch an.

Sie läuft ebenfalls in deinem Browser. Beim ersten Mal werden dafür einmalig etwa 20 MB Erkennungsdaten geladen.

Grenzen

  • Mehrspaltige Layouts und Tabellen kommen als Fließtext heraus.
  • Formatierung (fett, Schriftgröße) geht verloren – es ist reiner Text.
  • OCR ist bei schlechten Scans und Handschrift ungenau.