OCR-Scan – Dokument in lesbaren Text umwandeln
Lass eingescannte PDFs oder Foto-Dokumente mit OCR (Texterkennung) direkt in deinem Browser in lesbaren Text umwandeln, ohne dass eine Datei hochgeladen wird.
In diesem Themenbaum
- Akademie-Wissen
- Wissenschaftlich arbeiten
- KI- & Studien-Tools
- KI Detektor Deutsch | Bachelorarbeit…
- KI Disclaimer
- KI Verzeichnis erstellen
- KI-Detektoren im Preisvergleich
- KI-Richtlinien an Hochschulen
- KI-Text natürlicher machen
- KI-Tools für Hausarbeit &…
- Kostenlose KI-Tools für Texte
- OCR-Scan
- PDF & DOCX komprimieren
- Sapling AI Detector im Test
- Stichpunkte ausformulieren mit KI
- Text kürzen mit KI
- Text menschlicher schreiben mit KI
- Text umschreiben & paraphrasieren
- Text verlängern mit KI
- alle 28 Themen: KI- & Studien-Tools →
- KI- & Studien-Tools
- Wissenschaftlich arbeiten
OCR-Scan starten
Wähle deine Datei aus und starte anschließend den Scan. Prüfe das Ergebnis anschließend, bevor du es weiterverwendest.
100 % lokal
Deine Datei bleibt im Browser; der OCR-Scan wird vollständig auf deinem eigenen Gerät berechnet.
PDF & Bilder
OCR kann Text aus gescannten PDFs und abfotografierten Vorlagen erkennen.
Deutsch und Englisch
Tesseract stellt Sprachdaten für Deutsch und Englisch bereit. Bei gemischten Texten kann eine Nachkorrektur erforderlich sein.
Download als PDF
Du erhältst eine durchsuchbare PDF, benannt nach dem Muster ocrscan-korrektur-de-<dateiname>.pdf.
Wann ist ein OCR-Scan sinnvoll?
Ein OCR-Scan (Optical Character Recognition) wandelt Bildinhalte in maschinenlesbaren Text um. Er kann sinnvoll sein, wenn eine PDF nur aus Bildseiten besteht. Solche Dateien lassen sich häufig nicht durchsuchen oder von automatischen Seiten- oder Zeichenzählern auswerten.
Typische Fälle sind ein mit dem Handy fotografiertes Blatt, eine vom Scanner erzeugte PDF ohne Text-Ebene oder das Foto einer Tafel oder Buchseite. Du erhältst eine PDF mit erkanntem Text, den du etwa für das Korrekturlesen, das Lektorat, die Plagiatsprüfung oder die Normseiten-Berechnung verwenden kannst. Prüfe den erkannten Text zuvor auf Fehler.

So läuft der OCR-Scan ab
Im Hintergrund arbeitet die quelloffene OCR-Engine Tesseract, die per WebAssembly vollständig in deinem Browser läuft. Jede Seite deiner PDF wird zunächst als Bild gerendert, dann liest die Engine die Zeichen aus, und zum Schluss entsteht eine neue PDF mit dem erkannten Text. Da alles lokal passiert, verlassen sensible Dokumente niemals deinen Rechner.
Die Erkennungsqualität bei deutschen, englischen und gemischten Texten hängt unter anderem von Sprache, Bildqualität und Layout ab. Auch die Dauer hängt von Seitenzahl und Gerät ab; bei umfangreichen Dokumenten kann sie länger ausfallen.

Welche Dateiformate werden unterstützt?
Der Dienst verarbeitet aktuell PDF-Dateien sowie die Bildformate JPG, PNG und WEBP. Pro Datei sind bis zu 100 MB möglich. Word-Dokumente (DOCX), RTF- oder ODT-Dateien enthalten ihren Text ohnehin schon; hier genügt es meist, sie als PDF zu speichern und direkt weiterzugeben.