Kostenloses Online-Tool · PDF optimieren
Mit dieser OCR-Texterkennung machst du gescannte PDFs durchsuchbar und holst Text aus Bildern. Kostenlos, ohne Anmeldung – und ohne Upload, denn die OCR läuft direkt in deinem Browser.
Zieh eine gescannte PDF oder ein Foto (JPG, PNG, HEIC) in das Feld.
Wähle Deutsch, Englisch oder Deutsch und Englisch, je nach Sprache deines Dokuments.
Lade eine durchsuchbare PDF und/oder eine Textdatei mit dem erkannten Text herunter.
Nach der OCR kannst du im Dokument suchen und Text markieren und kopieren.
Fotos von Dokumenten, Screenshots oder iPhone-Bilder im HEIC-Format werden zu Text.
Die Erkennung ist auf deutsche und englische Texte ausgelegt, auch gemischt.
Die Texterkennung läuft lokal in deinem Browser. Deine Dokumente bleiben auf deinem Gerät.
Ohne Anmeldung, ohne Wasserzeichen, ohne Tageslimit.
OCR steht für „Optical Character Recognition“, auf Deutsch optische Zeichenerkennung oder einfach Texterkennung. Gemeint ist ein Verfahren, das Buchstaben auf einem Bild erkennt und in echten, digitalen Text verwandelt. Das ist nötig, weil ein Scan für den Computer nur ein Foto ist. Du siehst darauf zwar Wörter, aber du kannst sie weder suchen noch markieren noch kopieren.
Genau hier hilft dieses Tool. Die OCR-Erkennung liest deinen Scan oder dein Foto Zeile für Zeile und legt den erkannten Text unsichtbar unter das Bild. Das Dokument sieht danach genauso aus wie vorher, aber es ist durchsuchbar. Alternativ bekommst du den reinen Text als .txt-Datei, zum Beispiel um ihn in eine E-Mail oder ein Dokument einzufügen. Für die Erkennung nutzt das Tool die bewährte Open-Source-Software Tesseract.
Brauchst du nur den Text aus einer PDF, die schon echten Text enthält, ist PDF in Text der schnellere Weg. Dort ist keine Erkennung nötig, der Text wird direkt ausgelesen.
Wie gut die Texterkennung funktioniert, hängt vor allem von der Qualität der Vorlage ab. Mit diesen Tipps holst du am meisten heraus:
| Faktor | Empfehlung |
|---|---|
| Auflösung beim Scannen | 300 dpi, bei sehr kleiner Schrift auch mehr |
| Ausrichtung | Seite gerade, nicht schräg oder auf dem Kopf |
| Licht bei Handyfotos | gleichmäßig, ohne Schatten und Spiegelungen |
| Schrift | gedruckter Text; Handschrift wird kaum erkannt |
| Sprache | passend einstellen, bei gemischten Texten Deutsch+Englisch |
Liegen Seiten quer oder auf dem Kopf, dreh sie vorher mit PDF drehen. Die richtige Sprache ist wichtiger, als viele denken: Nur dann werden Umlaute wie ä, ö, ü und das ß zuverlässig erkannt. Rechne außerdem mit etwas Geduld. Die Erkennung dauert pro Seite einige Sekunden, bei langen Dokumenten entsprechend länger.
Keine OCR-Software ist fehlerfrei. Auch bei guten Vorlagen können einzelne Zeichen verwechselt werden, etwa die Ziffer 1 mit dem Buchstaben l oder die 0 mit einem O. Prüfe deshalb wichtige Zahlen wie Beträge oder IBAN-Angaben immer noch einmal nach.
Handschrift wird kaum erkannt. Für handschriftliche Notizen ist das Tool daher nicht geeignet. Auch sehr verschnörkelte Schriften, Text in Bildern mit unruhigem Hintergrund oder stark verblasste Kopien führen zu schlechteren Ergebnissen. Bei Tabellen wird der Inhalt erkannt, die Anordnung in Spalten kann in der Textdatei aber verloren gehen.
Ist das Ergebnis unbrauchbar, lohnt sich meist ein zweiter Versuch mit einer besseren Vorlage: Seite neu scannen oder fotografieren, auf gerade Ausrichtung und gutes Licht achten und die richtige Sprache wählen. Oft macht schon ein schärferes Foto einen deutlichen Unterschied. Prüfe außerdem, ob du wirklich die Sprache des Dokuments eingestellt hast.
Das Tool läuft in jedem aktuellen Browser, du brauchst also keine App und kein Programm. Trotzdem unterscheidet sich der Ablauf je nach Gerät ein wenig:
Fotografiere das Dokument möglichst gerade und bei gutem Licht. Öffne dann diese Seite, tippe auf das Auswahlfeld und wähle das Foto aus. iPhone-Fotos im HEIC-Format kannst du direkt verwenden, eine Umwandlung vorher ist nicht nötig. Bei mehrseitigen Dokumenten fasst du die Fotos am besten zuerst mit Bilder in PDF zu einer Datei zusammen und lässt dann die OCR darüber laufen. Weil die Erkennung auf dem Handy selbst rechnet, dauert sie dort oft etwas länger als am Computer.
Am Computer ziehst du die gescannte PDF einfach ins Browserfenster. Das ist die bequemste Lösung für lange Dokumente, weil ein Computer mehr Arbeitsspeicher und Rechenleistung hat. Scannst du selbst, stell deinen Scanner auf 300 dpi und Graustufen oder Farbe. Reine Schwarz-Weiß-Scans mit niedriger Auflösung liefern oft schlechtere Ergebnisse.
Gescannte Dokumente sind oft besonders sensibel: Gehaltsabrechnungen, Arztbriefe, Ausweiskopien oder Verträge. Viele OCR-Dienste im Netz laden diese Dateien auf ihre Server. Hier ist das anders. Die komplette Texterkennung läuft in deinem Browser auf deinem eigenen Gerät. Deine Dateien werden nicht übertragen und nirgends gespeichert. Wie große Dokumente du verarbeiten kannst, hängt vom Arbeitsspeicher deines Geräts ab. Am Computer geht das meist mit deutlich größeren Dateien als am Handy.
Ist OCR kostenlos? Mit diesem Tool ja, ohne Anmeldung und ohne Limit pro Tag. Es gibt auch andere kostenlose OCR-Software, etwa Open-Source-Programme zum Installieren oder die Texterkennung in manchen Smartphone-Kameras. Das iPhone zum Beispiel kann Text in Fotos markieren und kopieren. Für ganze PDFs mit vielen Seiten ist eine OCR-PDF-Lösung wie diese aber meist praktischer, weil du am Ende eine durchsuchbare Datei hast.
Hat Word eine OCR-Funktion? Word kann PDFs öffnen und versucht, sie in bearbeitbaren Text umzuwandeln. Bei reinen Scans klappt das oft nur eingeschränkt. Zuverlässiger ist es, den Scan zuerst hier per OCR durchsuchbar zu machen und dann weiterzuverarbeiten. Du findest dieses Tool übrigens auch unter Namen wie OCR online, OCR-Scanner, PDF OCR, Bild zu Text oder Text aus Bild extrahieren.
Ja, diese OCR-Texterkennung ist kostenlos, ohne Anmeldung und ohne Tageslimit. Sie läuft direkt in deinem Browser, eine Installation ist nicht nötig.
Neben diesem Browser-Tool gibt es kostenlose Open-Source-Programme zum Installieren. Dieses Tool basiert selbst auf der Open-Source-Software Tesseract, braucht aber keine Installation und lädt deine Dateien nicht hoch.
Gemeint ist meist: ein gescanntes PDF durchsuchbar machen. Zieh die PDF in das Feld oben, wähle die Sprache und starte die Erkennung. Danach lädst du die durchsuchbare PDF oder eine Textdatei herunter.
Word kann PDFs öffnen und in bearbeitbaren Text umwandeln, bei reinen Scans ist das Ergebnis aber oft unzuverlässig. Mach den Scan besser zuerst per OCR durchsuchbar und wandle ihn danach in Word um.
Ja. Lade ein JPG, PNG oder HEIC-Foto hoch und wähle die Textdatei als Ergebnis. Den erkannten Text kannst du dann kopieren und weiterverwenden.
Kaum. Die Texterkennung ist auf gedruckten Text ausgelegt. Handschriftliche Notizen werden meist nicht oder nur fehlerhaft erkannt.
Deutsch, Englisch und die Kombination aus beiden. Wähle die passende Sprache, damit Umlaute und ß korrekt erkannt werden.
Nein. Die Texterkennung läuft komplett in deinem Browser. Deine Scans und Fotos verlassen dein Gerät nicht.