Das Sprachpaket ist zuerst Englisch. Screenshots und klare Druckschrift funktionieren besser als Handschrift oder Stempel. Digitalen PDF-Text holen Sie ohne OCR.
Screenshot auf Englisch, ein Scan ohne Textschicht: OCR im Tab. Die Engine startet mit Englisch.
Das ist kein Ausweis-Scanner und kein „beliebig Deutsch“.
Zuerst Englisch
- UI-Strings, englische Belege, Übungen.
- Digitales PDF: PDF-Text extrahieren
- Seitenbilder: PDF nach JPG, dann hier — immer noch
eng
HEIC: HEIC nach JPG. Zählen: Wortzähler.
Grenzen
Keine Übertragung, kein Behörden-OCR, keine Garantie auf Umlaute. Wer deutsche Akten braucht, nimmt eine Engine mit deu — nicht diese Seite als Versprechen.
Ablauf und Stolpersteine
- Helles, gerades Bild. Schräge Handyfotos von deutschsprachigen Bescheiden scheitern oft — die Engine ist zuerst
eng. - Digitales PDF mit Textschicht: extrahieren, nicht OCR.
- Ausweise nicht „mal schnell“ durchjagen. Das versprechen wir nicht.
Stolperstein: Fraktur, Stempel, blaue Tinte. Sie bekommen Text, keine durchsuchbare PDF-Schicht. Rund 32 MB, erste Initialisierung darf dauern.