OCR-Scan – Dokument in lesbaren Text umwandeln

Lass eingescannte PDFs oder Foto-Dokumente online per OCR (Texterkennung) in lesbaren Text umwandeln, aus dem Scan wird ein Dokument mit lesbarem Text direkt in deinem Browser, nichts wird hochgeladen.

OCR-Scan starten

Wähle deine Datei aus und tippe danach auf „OCR-Scan starten". Die Texterkennung läuft direkt in deinem Browser, das Ergebnis bekommst du als durchsuchbare PDF zurück.

Datei hier ablegen oder klicken
PDF, DOCX, DOC, TXT, ODT, RTF, JPG, PNG, WEBP · Max. 100 MB

100 % lokal

Deine Datei bleibt im Browser, der OCR-Scan wird vollständig auf deinem eigenen Gerät berechnet.

PDF & Bilder

Liest den Text sowohl aus gescannten PDFs als auch aus abfotografierten Vorlagen (JPG, PNG, WEBP).

🇩🇪
OCR-Scan – Dokument in lesbaren Text umwandeln
OCR-Scan, Dokument in lesbaren Text umwandeln im Überblick.

Deutsch & Englisch

Tesseract-OCR bringt Sprachmodelle für Deutsch und Englisch mit, auch gemischte Texte sind kein Problem.

Download als PDF

Du erhältst eine durchsuchbare PDF, benannt nach dem Muster ocrscan-korrektur-de-<dateiname>.pdf.

Wofür lohnt sich ein OCR-Scan?

Ein OCR-Scan (Optical Character Recognition) übersetzt Bildinhalte in maschinenlesbaren Text. Nötig wird er immer dann, wenn deine PDF nur ein reiner Scan ist: Sie sieht zwar aus wie beschriebenes Papier, besteht technisch aber bloß aus einem Bild. Solche Dateien lassen sich weder durchsuchen noch von automatischen Seiten- oder Zeichenzählern auswerten.

Klassische Beispiele: ein mit dem Handy abfotografiertes Blatt, eine vom Scanner erzeugte PDF ganz ohne Text-Ebene oder das Foto einer Tafel oder Buchseite. Am Ende bekommst du eine PDF mit sauber ausgelesenem Text, die sich anschließend fürs Korrekturlesen, das Lektorat, die Plagiatsprüfung oder die Normseiten-Berechnung nutzen lässt.

OCR-Scan – Dokument in lesbaren Text umwandeln

So läuft der OCR-Scan ab

Im Hintergrund arbeitet die quelloffene OCR-Engine Tesseract, die per WebAssembly vollständig in deinem Browser läuft. Jede Seite deiner PDF wird zunächst als Bild gerendert, dann liest die Engine die Zeichen aus, und zum Schluss entsteht eine neue PDF mit dem erkannten Text. Da alles lokal passiert, verlassen sensible Dokumente niemals deinen Rechner.

Erkannt werden Deutsch und Englisch, auch bunt gemischte Texte bereiten keine Schwierigkeiten. Wie lange es dauert, hängt von Seitenzahl und Gerät ab, von wenigen Sekunden bis zu einigen Minuten. Bei umfangreichen Dokumenten gedulde dich bitte einen Moment, den Fortschritt siehst du dabei live mitlaufen.

Welche Formate kannst du hochladen?

Aktuell verarbeitet unser OCR-Scan PDF-Dateien sowie die Bildformate JPG, PNG und WEBP. Pro Datei sind bis zu 100 MB möglich. Word-Dokumente (DOCX), RTF- oder ODT-Dateien enthalten ihren Text ohnehin schon, hier genügt es meist, sie als PDF zu speichern und direkt weiterzugeben.

Schnellübersicht

Datenschutz100 % lokal
SprachenDeutsch, Englisch
FormatePDF, JPG, PNG, WEBP
Max. Größe100 MB
Preiskostenlos

Weitere Themen aus der Akademie-Wissen

Unsere Partner