OCR / Bild zu Text

Verarbeitung in diesem Browser

Dateilimit: 32 MB

Dieses Tool lädt Ihre Eingabe nicht hoch.

Beim ersten Mal kann der Browser eine Bibliothek laden.

Tesseract zuerst auf Englisch (eng). Keine Ausweise, kein CJK. Das Modell lädt beim ersten Mal in diesem Tab.

Datei ablegen

Datei hier ablegen oder auswählen.

Beispiel: Textfoto ablegen und starten. Das Modell lädt beim ersten Mal.

Das Sprachpaket ist zuerst Englisch. Screenshots und klare Druckschrift funktionieren besser als Handschrift oder Stempel. Digitalen PDF-Text holen Sie ohne OCR.

Screenshot auf Englisch, ein Scan ohne Textschicht: OCR im Tab. Die Engine startet mit Englisch.

Das ist kein Ausweis-Scanner und kein „beliebig Deutsch“.

Zuerst Englisch

HEIC: HEIC nach JPG. Zählen: Wortzähler.

Grenzen

Keine Übertragung, kein Behörden-OCR, keine Garantie auf Umlaute. Wer deutsche Akten braucht, nimmt eine Engine mit deu — nicht diese Seite als Versprechen.

Ablauf und Stolpersteine

  1. Helles, gerades Bild. Schräge Handyfotos von deutschsprachigen Bescheiden scheitern oft — die Engine ist zuerst eng.
  2. Digitales PDF mit Textschicht: extrahieren, nicht OCR.
  3. Ausweise nicht „mal schnell“ durchjagen. Das versprechen wir nicht.

Stolperstein: Fraktur, Stempel, blaue Tinte. Sie bekommen Text, keine durchsuchbare PDF-Schicht. Rund 32 MB, erste Initialisierung darf dauern.

Häufige Fragen

Welche Sprache liest die Engine zuerst?

Englisch (eng). Deutsche Umlaute und Fraktur sind nicht der Schwerpunkt. Ausweise und Reisepässe lesen wir absichtlich nicht als Produktversprechen.

Unterschied zu PDF-Text extrahieren?

Digitale PDFs mit Textschicht: extrahieren. Fotos und Scans ohne Text: OCR — mit den genannten Sprachgrenzen.

Wird das Bild hochgeladen?

Nein. Erkennung im Tab, rund 32 MB. Modelle können groß sein; der erste Lauf darf dauern.

Durchsuchbares PDF?

Nein. Sie bekommen Text, keine neue PDF-Textschicht.

Handschrift?

Unzuverlässig. Kein Ersatz für Abschrift von Hand.

Verwandte Tools