OCR-Scan – Dokument in lesbaren Text umwandeln

Lass eingescannte PDFs oder Foto-Dokumente mit OCR (Texterkennung) direkt in deinem Browser in lesbaren Text umwandeln, ohne dass eine Datei hochgeladen wird.

OCR-Scan starten

Wähle deine Datei aus und starte anschließend den Scan. Prüfe das Ergebnis anschließend, bevor du es weiterverwendest.

Datei hier ablegen oder klicken
PDF, DOCX, DOC, TXT, ODT, RTF, JPG, PNG, WEBP · Max. 100 MB

100 % lokal

Deine Datei bleibt im Browser; der OCR-Scan wird vollständig auf deinem eigenen Gerät berechnet.

PDF & Bilder

OCR kann Text aus gescannten PDFs und abfotografierten Vorlagen erkennen.

Deutsch und Englisch

Tesseract stellt Sprachdaten für Deutsch und Englisch bereit. Bei gemischten Texten kann eine Nachkorrektur erforderlich sein.

Download als PDF

Du erhältst eine durchsuchbare PDF, benannt nach dem Muster ocrscan-korrektur-de-<dateiname>.pdf.

Wann ist ein OCR-Scan sinnvoll?

Ein OCR-Scan (Optical Character Recognition) wandelt Bildinhalte in maschinenlesbaren Text um. Er kann sinnvoll sein, wenn eine PDF nur aus Bildseiten besteht. Solche Dateien lassen sich häufig nicht durchsuchen oder von automatischen Seiten- oder Zeichenzählern auswerten.

Typische Fälle sind ein mit dem Handy fotografiertes Blatt, eine vom Scanner erzeugte PDF ohne Text-Ebene oder das Foto einer Tafel oder Buchseite. Du erhältst eine PDF mit erkanntem Text, den du etwa für das Korrekturlesen, das Lektorat, die Plagiatsprüfung oder die Normseiten-Berechnung verwenden kannst. Prüfe den erkannten Text zuvor auf Fehler.

OCR-Scan – Dokument in lesbaren Text umwandeln
OCR-Scan, Dokument in lesbaren Text umwandeln im Überblick.

So läuft der OCR-Scan ab

Im Hintergrund arbeitet die quelloffene OCR-Engine Tesseract, die per WebAssembly vollständig in deinem Browser läuft. Jede Seite deiner PDF wird zunächst als Bild gerendert, dann liest die Engine die Zeichen aus, und zum Schluss entsteht eine neue PDF mit dem erkannten Text. Da alles lokal passiert, verlassen sensible Dokumente niemals deinen Rechner.

Die Erkennungsqualität bei deutschen, englischen und gemischten Texten hängt unter anderem von Sprache, Bildqualität und Layout ab. Auch die Dauer hängt von Seitenzahl und Gerät ab; bei umfangreichen Dokumenten kann sie länger ausfallen.

OCR-Scan – Dokument in lesbaren Text umwandeln

Welche Dateiformate werden unterstützt?

Der Dienst verarbeitet aktuell PDF-Dateien sowie die Bildformate JPG, PNG und WEBP. Pro Datei sind bis zu 100 MB möglich. Word-Dokumente (DOCX), RTF- oder ODT-Dateien enthalten ihren Text ohnehin schon; hier genügt es meist, sie als PDF zu speichern und direkt weiterzugeben.

Schnellübersicht

Datenschutz100 % lokal
SprachenDeutsch, Englisch
FormatePDF, JPG, PNG, WEBP
Max. Größe100 MB
Preiskostenlos

Weitere Themen aus der Akademie-Wissen

Unsere Partner