Tekst herkennen in een gescande PDF (OCR)
Haal tekst uit een gescande PDF met OCR (optische tekenherkenning). Kies de taal van het document voor de beste nauwkeurigheid en download de herkende tekst als bestand. Alles verloopt lokaal in je browser, geen upload vereist.
Kies je PDF
Sleep hierheen of klik om te kiezen
Bestand blijft op je apparaat — niets wordt geüpload
advertentie
Je bestand wordt in je browser verwerkt en niet geüpload.
Hoe werkt het?
- 1
Kies je gescande PDF
Sleep de PDF hierheen.
- 2
Kies de documenttaal
Kies de taal van de tekst in het document voor de beste herkenning.
- 3
OCR starten
Elke pagina wordt gerenderd en de tekst herkend. Dit duurt even.
- 4
Downloaden
Download de herkende tekst als .txt-bestand.
Veelgestelde vragen
Hoe lang duurt OCR?
Bij de eerste keer worden de taalgegevens voor Tesseract geladen — dat is een bestand van ongeveer 10 MB per taal. Daarna duurt elke pagina enkele seconden, afhankelijk van de hoeveelheid tekst en de kwaliteit van de scan. Een PDF van 10 pagina's duurt typisch 30-60 seconden.
Hoe nauwkeurig is de tekstherkenning?
De nauwkeurigheid hangt af van de scankwaliteit. Een duidelijke scan van een getypte tekst op 300 dpi of hoger geeft uitstekende resultaten — typisch 95% of beter. Handgeschreven tekst, lage resolutie of vage scans geven slechtere resultaten. Kies altijd de juiste taal voor de beste nauwkeurigheid.
Welke talen worden ondersteund?
De tool ondersteunt tientallen talen via de Tesseract-OCR-bibliotheek, waaronder Nederlands, Engels, Duits, Frans, Spaans, Italiaans, Portugees, en vele andere. Kies de taal die overeenkomt met de taal van het document.
Werkt dit ook op een gewone PDF met tekst?
Gebruik daarvoor de tool 'PDF naar tekst' — die is veel sneller voor PDF's met een echte tekstlaag. OCR is specifiek bedoeld voor gescande documenten waarbij de tekst als afbeelding is opgeslagen.
Wat als mijn scan scheef staat?
Rechtzet je scan eerst met de 'PDF roteren'-tool. OCR werkt het beste als de tekst recht staat — scheve tekst vermindert de nauwkeurigheid aanzienlijk.
Worden mijn bestanden geüpload?
Nee. Alles gebeurt in je eigen browser. Je bestand verlaat je toestel niet en wordt nergens opgeslagen.
Is het gratis?
Ja, volledig gratis en zonder watermerk of account. De site wordt betaald uit advertenties.
Meer lezen
Waarom in de browser?
PDFrust draait volledig in je browser via WebAssembly en moderne JavaScript-bibliotheken zoals pdf-lib en PDF.js. Je bestand wordt nooit naar een server gestuurd — alle verwerking vindt lokaal op je apparaat plaats. Dat betekent dat je documenten standaard privé blijven, ongeacht wat ze bevatten. Er is geen account nodig, geen limiet op bestandsgrootte en er wordt niets opgeslagen nadat je het tabblad sluit.
Gerelateerde tools