PDF OCR (Durchsuchbares PDF)
Führen Sie OCR auf einem gescannten PDF durch, um es durchsuchbar und kopierbar zu machen, mit einer unsichtbaren Texterschicht hinter jeder Seite.
Kurze Antwort: PDF OCR (Durchsuchbares PDF): Wendet OCR auf ein gescanntes PDF an, um es durchsuchbar zu machen und Text daraus kopierbar zu machen – mit einer unsichtbaren Textebene hinter jeder Seite. Läuft vollständig kostenlos und ohne Anmeldung im Browser.
Zuletzt aktualisiert
Gut zu wissen
OCR turns a picture of text back into real, selectable characters. A scanned PDF is just an image wrapped in a page, so Ctrl/Cmd+F finds nothing and screen readers see a blank page. This tool recognizes the words and writes them back as an invisible layer sitting exactly under the visible image, so the page looks untouched while search, copy and assistive technology all suddenly work.
Input quality is everything. The engine renders pages at 200 DPI, but recognition accuracy climbs sharply when the source scan itself is 300 DPI or higher. Clean, high-contrast printed text lands in the 95–99% range; faint photocopies, decorative fonts, tables and especially handwriting drag that down fast. Scanning in grayscale rather than color, and running a crooked scan through Rotate PDF first, both pay off.
Pick the correct language before you start — the model is trained per language, and choosing the wrong one will happily invent plausible-looking nonsense for accented characters. OCR is also genuinely CPU-heavy: budget a few seconds per page, so a long document can take several minutes. If you only need the raw words rather than a searchable copy, the lighter PDF to Text is quicker for PDFs that already contain a text layer.
Häufig gestellte Fragen
- Was ist OCR für PDFs?
- OCR (optische Zeichenerkennung) liest die Pixel gescannter Seiten und erkennt die Wörter. Diese Wörter werden dann als unsichtbare Textebene in das PDF zurückgeschrieben, sodass Suchen, Kopieren und Bildschirmlesegeräte funktionieren.
- Kann OCR ein gescanntes PDF durchsuchbar machen?
- Ja — genau das ist der Zweck. Nach der OCR-Funktion findet man mit Ctrl/Cmd+F in jedem PDF-Reader die Wörter innerhalb des Scans.
- Wie genau ist PDF OCR?
- Tesseract hat typischerweise eine Genauigkeit von 95-99 % bei sauber gedrucktem Text mit 300 DPI. Die Genauigkeit sinkt bei minderwertigen Scans, handschriftlichem Text und ungewöhnlichen Schriften. Höhere Auflösungen bei den Quellscans liefern die besten Ergebnisse.
- Unterstützt OCR mehrere Sprachen?
- Ja. Wählen Sie aus Englisch, Niederländisch, Deutsch, Französisch, Spanisch oder Italienisch. Jedes Sprachmodell wird bei der ersten Nutzung heruntergeladen (ca. 10 MB) und im Cache gespeichert.
- Kann OCR mit rotierten Seiten umgehen?
- Es bewältigt kleine Schiefstellungen gut. Für Seiten, die um 90° oder 180° rotiert sind, führen Sie sie zuerst durch Rotate PDF und dann durch OCR.
- Gibt es eine Seitenbeschränkung?
- Keine feste Grenze. OCR ist jedoch CPU-intensiv, sodass jede Seite einige Sekunden benötigt — ein 100-seitiges PDF kann auf einem typischen Laptop mehrere Minuten dauern. Der Fortschrittsbalken zeigt den aktuellen Status an.
- Ändert OCR das Aussehen meines PDFs?
- Nein. Das Seitenbild wird exakt beibehalten; der OCR-Text wird als unsichtbare Ebene darunter hinzugefügt. Die sichtbare Seite sieht identisch wie das Original aus.
- Ist OCR sicher für sensible Dokumente?
- Ja. Der gesamte Prozess läuft in Ihrem Browser — das PDF und die OCR-Ergebnisse verlassen nie Ihr Gerät.
- Kann ich Text nach der OCR-Funktion kopieren?
- Ja. Öffnen Sie das resultierende PDF in einem beliebigen Reader (Acrobat, Vorschau, Browser-PDF-Viewer), markieren Sie den Text und fügen Sie ihn ein — die OCR-Wörter sind die, die kopiert werden.
- Warum übersieht OCR einige Zeichen?
- Häufige Ursachen: Scans mit niedriger Auflösung, ungewöhnliche Schriftarten, sehr kleiner Text oder Text auf einem strukturierten Hintergrund. Scannen Sie am besten mit 300 DPI in Graustufen (oder verwenden Sie zuerst unser PDF zu Graustufen-Tool) für die besten Ergebnisse.