PDF OCR (Doorzoekbare PDF)
Voer OCR uit op een gescande PDF om deze doorzoekbaar en kopieerbaar te maken, met een onzichtbare tekstlaag achter elke pagina.
Snel antwoord: PDF OCR (Doorzoekbare PDF): voer OCR uit op een gescande PDF zodat deze doorzoekbaar wordt en tekst gekopieerd kan worden, dankzij een onzichtbare tekstlaag achter elke pagina. Werkt volledig in je browser, gratis en zonder registratie.
Laatst bijgewerkt
Goed om te weten
OCR turns a picture of text back into real, selectable characters. A scanned PDF is just an image wrapped in a page, so Ctrl/Cmd+F finds nothing and screen readers see a blank page. This tool recognizes the words and writes them back as an invisible layer sitting exactly under the visible image, so the page looks untouched while search, copy and assistive technology all suddenly work.
Input quality is everything. The engine renders pages at 200 DPI, but recognition accuracy climbs sharply when the source scan itself is 300 DPI or higher. Clean, high-contrast printed text lands in the 95–99% range; faint photocopies, decorative fonts, tables and especially handwriting drag that down fast. Scanning in grayscale rather than color, and running a crooked scan through Rotate PDF first, both pay off.
Pick the correct language before you start — the model is trained per language, and choosing the wrong one will happily invent plausible-looking nonsense for accented characters. OCR is also genuinely CPU-heavy: budget a few seconds per page, so a long document can take several minutes. If you only need the raw words rather than a searchable copy, the lighter PDF to Text is quicker for PDFs that already contain a text layer.
Veelgestelde vragen
- Wat is OCR voor PDF's?
- OCR (optische tekenherkenning) leest de pixels van gescande pagina's en herkent de woorden. We schrijven die woorden vervolgens terug in de PDF als een onzichtbare tekstlaag, zodat zoeken, kopiëren en schermlezers allemaal werken.
- Kan OCR een gescande PDF doorzoekbaar maken?
- Ja - dat is precies wat het doet. Na OCR zal Ctrl/Cmd+F in elke PDF-lezer woorden binnen de scan vinden.
- Hoe nauwkeurig is PDF OCR?
- Tesseract is doorgaans 95-99% nauwkeurig op schone afgedrukte tekst bij 300 DPI. De nauwkeurigheid daalt bij scans van lage kwaliteit, handschriften en ongebruikelijke lettertypen. Scans met een hogere resolutie geven de beste resultaten.
- Ondersteunt OCR meerdere talen?
- Ja. Kies uit Engels, Nederlands, Duits, Frans, Spaans of Italiaans. Elk taamodel wordt gedownload bij het eerste gebruik (ongeveer 10 MB) en wordt gecached.
- Kan OCR omgedraaide pagina's verwerken?
- Het kan kleine scheefheid goed verwerken. Voor pagina's die 90° of 180° zijn gedraaid, loopt u ze eerst door Rotate PDF, gevolgd door OCR.
- Is er een paginalimiet?
- Geen vaste limiet. OCR is echter CPU-intensief, dus elke pagina kost een paar seconden - een PDF van 100 pagina's kan enkele minuten duren op een typische laptop. De voortgangsbalk toont de live status.
- Zal OCR de uitstraling van mijn PDF veranderen?
- Nee. De pagina-afbeelding wordt exact bewaard; de OCR-tekst wordt toegevoegd als een onzichtbare laag erachter. De zichtbare pagina lijkt identiek aan het origineel.
- Is OCR veilig voor gevoelige documenten?
- Ja. Het hele proces draait in uw browser - de PDF en de OCR-resultaten verlaten nooit uw apparaat.
- Kan ik tekst kopiëren na OCR?
- Ja. Open de resulterende PDF in elke lezer (Acrobat, Preview, browser PDF-viewer), selecteer tekst en plak - de OCR-woorden zijn wat gekopieerd wordt.
- Waarom mist OCR sommige tekens?
- Veelvoorkomende oorzaken: lage resolutie scans, ongebruikelijke lettertypen, zeer kleine tekst of tekst op een gestructureerde achtergrond. Scan opnieuw bij 300 DPI in grijswaarden (of gebruik eerst onze PDF naar Grayscale-tool) voor de beste resultaten.