PDFrust.NL·EN
alle tools

Tekst herkennen in een gescande PDF (OCR)

Haal tekst uit een gescande PDF met OCR (optische tekenherkenning). Kies de taal van het document voor de beste nauwkeurigheid en download de herkende tekst als bestand. Alles verloopt lokaal in je browser, geen upload vereist.

Kies je PDF

Sleep hierheen of klik om te kiezen

Bestand blijft op je apparaat — niets wordt geüpload

advertentie

Je bestand wordt in je browser verwerkt en niet geüpload.

Hoe werkt het?

  1. 1

    Kies je gescande PDF

    Sleep de PDF hierheen.

  2. 2

    Kies de documenttaal

    Kies de taal van de tekst in het document voor de beste herkenning.

  3. 3

    OCR starten

    Elke pagina wordt gerenderd en de tekst herkend. Dit duurt even.

  4. 4

    Downloaden

    Download de herkende tekst als .txt-bestand.

Veelgestelde vragen

Hoe lang duurt OCR?

Bij de eerste keer worden de taalgegevens voor Tesseract geladen — dat is een bestand van ongeveer 10 MB per taal. Daarna duurt elke pagina enkele seconden, afhankelijk van de hoeveelheid tekst en de kwaliteit van de scan. Een PDF van 10 pagina's duurt typisch 30-60 seconden.

Hoe nauwkeurig is de tekstherkenning?

De nauwkeurigheid hangt af van de scankwaliteit. Een duidelijke scan van een getypte tekst op 300 dpi of hoger geeft uitstekende resultaten — typisch 95% of beter. Handgeschreven tekst, lage resolutie of vage scans geven slechtere resultaten. Kies altijd de juiste taal voor de beste nauwkeurigheid.

Welke talen worden ondersteund?

De tool ondersteunt tientallen talen via de Tesseract-OCR-bibliotheek, waaronder Nederlands, Engels, Duits, Frans, Spaans, Italiaans, Portugees, en vele andere. Kies de taal die overeenkomt met de taal van het document.

Werkt dit ook op een gewone PDF met tekst?

Gebruik daarvoor de tool 'PDF naar tekst' — die is veel sneller voor PDF's met een echte tekstlaag. OCR is specifiek bedoeld voor gescande documenten waarbij de tekst als afbeelding is opgeslagen.

Wat als mijn scan scheef staat?

Rechtzet je scan eerst met de 'PDF roteren'-tool. OCR werkt het beste als de tekst recht staat — scheve tekst vermindert de nauwkeurigheid aanzienlijk.

Worden mijn bestanden geüpload?

Nee. Alles gebeurt in je eigen browser. Je bestand verlaat je toestel niet en wordt nergens opgeslagen.

Is het gratis?

Ja, volledig gratis en zonder watermerk of account. De site wordt betaald uit advertenties.

Meer lezen

Een gescande PDF doorzoekbaar makenEen gescande PDF is eigenlijk een afbeelding — je kunt de tekst niet selecteren of doorzoeken.Woorden tellen in een PDFHoeveel woorden staan er in je PDF-document? De woordtelling-tool van PDFrust analyseert elke pagina en geeft je direct het totale aantal woorden, tekens en pagina's — gratis, zonder upload.

Waarom in de browser?

PDFrust draait volledig in je browser via WebAssembly en moderne JavaScript-bibliotheken zoals pdf-lib en PDF.js. Je bestand wordt nooit naar een server gestuurd — alle verwerking vindt lokaal op je apparaat plaats. Dat betekent dat je documenten standaard privé blijven, ongeacht wat ze bevatten. Er is geen account nodig, geen limiet op bestandsgrootte en er wordt niets opgeslagen nadat je het tabblad sluit.

Gerelateerde tools

JPG naar PDFZet één of meerdere foto's (JPG, PNG, HEIC of WebP) om naar een PDF.PDF naar JPGZet elke pagina van een PDF om naar een JPG-afbeelding en download ze los.