Wenn das PDF schon echte Buchstaben enthält, holen Sie den Text hier heraus. Eine fotografierte Seite ohne Textschicht bleibt leer — das ist dann OCR, nicht dieses Werkzeug.
Sie wollen Sätze aus einem digitalen PDF, nicht ein Foto der Seite. Angebote aus Word, Bescheide als Text-PDF, Specs aus dem Entwicklerportal.
Diese Seite liest die vorhandene Textschicht. Sie erkennt keine Buchstaben in Pixeln. Dafür ist OCR zuständig, und das Modell ist zuerst Englisch.
Wann Extrahieren greift
- Kopierbarer Text im Acrobat-Reader, den Sie nur schneller komplett brauchen.
- Protokolle, die Sie in den Editor übernehmen wollen.
- Debugging: Steht im PDF überhaupt Text oder nur Bilder?
Scan vom Handy, Stempel, handschriftliche Notiz: zuerst prüfen, ob Markieren überhaupt geht. Sonst Seite als Bild exportieren unter PDF nach JPG und dann OCR — oder das Original behalten, bevor Sie komprimieren.
Grenzen
- Tabellen und mehrspaltiges Layout kommen selten sauber an.
- Ligaturen und eingebettete Sonderfonts können Zeichen verdrehen.
- Rund 32 MB, passwortgeschützte Dateien oft nicht, keine Übertragung.
Kein Rechts- oder Archivprodukt. Sensible PDFs bleiben im Tab — das ersetzt keine Aktenführung.