PDF Tekstherkenning

Haal tekst uit gescande PDF's en maak ze doorzoekbaar. Detecteert automatisch de documenttaal. 100% lokaal — niets wordt geüpload.

✓ Geen limiet op bestandsgrootte ✓ Geen account vereist ✓ Geen watermerk toegevoegd ✓ Voor altijd gratis
Sleep je bestanden hier naartoe
of klik om te bladeren — onbeperkt aantal bestanden
Je bestand verlaat nooit de browser — lokaal verwerkt, geen upload

PDF OCR Gratis — Maak Gescande PDF's Doorzoekbaar

Haal tekst uit gescande PDF's, maak ze doorzoekbaar en kopieer de inhoud — rechtstreeks in je browser met OCR (optische tekenherkenning). Geen software om te installeren, geen account nodig, en je bestanden verlaten nooit je apparaat.

PDFree detecteert automatisch de taal van je document voordat de OCR start, dus je hoeft niet te raden. Werkt met gescande contracten, studieboeken, facturen en archiefdocumenten in tientallen talen en schriften.

Wat is OCR? OCR (optische tekenherkenning) zet een afbeelding-PDF — een gescand document waarbij elke pagina een foto is — om in een doorzoekbare PDF door een onzichtbare tekstlaag over de originele afbeeldingen te leggen. PDFree voert OCR volledig in je browser uit met Tesseract.js; je bestand wordt nooit naar een server geüpload. Het originele uiterlijk van het document blijft exact behouden.

Zo maak je een gescande PDF doorzoekbaar

1
Open je gescande PDF

Sleep het bestand of klik op "PDF kiezen". PDFree detecteert automatisch of je PDF al een tekstlaag heeft of gewoon een gescande afbeelding is.

2
Laat PDFree de taal detecteren, of kies zelf

Voor gescande PDF's: klik op OCR-engine installeren om Tesseract.js te laden (~17 MB, eenmalige download). PDFree analyseert de pagina en stelt automatisch de documenttaal voor; je kunt dit wijzigen via het dropdownmenu indien nodig. PDF's met een tekstlaag slaan deze stap over.

3
Klik op "PDF Doorzoekbaar Maken"

De herkenningsmachine verwerkt elke pagina lokaal — er wordt niets geüpload. Een voortgangsbalk toont de geschatte resterende tijd.

4
Download je doorzoekbare PDF

Je PDF wordt automatisch gedownload zodra de tekstherkenning klaar is. Het originele uiterlijk verandert niet; er wordt alleen een onzichtbare tekstlaag toegevoegd zodat je in elke PDF-lezer kunt zoeken, selecteren en tekst kopiëren.

Wanneer OCR gebruiken

OCR is handig zodra je een document als afbeelding hebt en met de tekst erin moet werken:

  • Juridisch — zoeken in oude contracten en rechtbankdocumenten gescand van papier
  • Studenten — tekst kopiëren uit gescande studieboeken, passages markeren, overnemen in notities
  • Boekhouding — gescande facturen en bonnen doorzoekbaar maken voor audits
  • Zorg — papieren patiëntendossiers digitaliseren zonder dat bestanden het apparaat verlaten
  • Onderzoekers — gescande wetenschappelijke artikelen en archiefdocumenten doorzoekbaar maken
  • Overheid / HR — papieren formulieren archiveren als doorzoekbare digitale documenten

Tekst-PDF's vs gescande PDF's — wat is het verschil?

PDFree detecteert automatisch welk type PDF je hebt. PDF's met een tekstlaag (de meeste digitaal gemaakte PDF's — uit Word, Google Docs of andere moderne apps) bevatten al machine-leesbare tekst — extractie is direct en er is geen OCR-engine nodig. Gescande PDF's (foto's van pagina's, faxen, oude archiefscans) bevatten alleen afbeeldingen en hebben OCR nodig om pixels om te zetten in selecteerbare, doorzoekbare tekst.

Automatische taaldetectie — geen giswerk nodig

De meeste OCR-tools verplichten je vooraf de documenttaal te kiezen, en een verkeerde keuze verpest stilletjes de nauwkeurigheid. PDFree analyseert in plaats daarvan de inhoud van de pagina en stelt automatisch de juiste taal voor — een echt onderscheidende functie, omdat de herkenningsengine onafhankelijk werkt van welke van de 6 PDFree-interfacetalen je gebruikt. Lees je een scan in het Russisch, Japans of Turks terwijl je de Nederlandse interface gebruikt? De detectie vindt nog steeds de echte taal van het document. Je kunt de suggestie altijd handmatig overschrijven.

18 talen ondersteund

PDFree gebruikt Tesseract.js, een toonaangevende open-source tekstherkenningsengine, en ondersteunt 18 talen: Engels, Frans, Duits, Spaans, Italiaans, Portugees, Russisch, Oezbeeks, Nederlands, Pools, Turks (Europese schriften) en Arabisch, Japans, Chinees vereenvoudigd, Chinees traditioneel, Koreaans, Hindi, Thais (complexe schriften).

Wat beïnvloedt de OCR-kwaliteit?

  • Scanresolutie — 300 DPI of hoger geeft de beste resultaten. Onder 150 DPI worden dunne lijnen en kleine tekst moeilijk te herkennen.
  • Paginauitlijning — scheve of gedraaide pagina's verminderen de nauwkeurigheid. PDFree corrigeert automatisch de PDF-rotatie (90°/180°/270°), maar niet de fysieke scheefstand van de scan.
  • Gedrukt vs handschrift — gedrukte tekst wordt goed herkend; cursief handschrift wordt niet ondersteund door Tesseract.
  • Taalovereenkomst — automatische detectie kiest meestal het juiste model; selecteer bij meertalige documenten handmatig de dominante taal voor het beste resultaat.

Doorzoekbare PDF vs platte tekst — wat downloaden?

De doorzoekbare PDF behoudt je originele gescande afbeeldingen exact en voegt er een onzichtbare tekstlaag aan toe — handig voor archivering, zoeken in een PDF-lezer of delen. Het .txt-bestand bevat alleen de geëxtraheerde platte tekst met paginascheidingen — handig om te bewerken in Word of te importeren in een andere tool. Schakel "Ook .txt-kopie downloaden" in om beide bestanden tegelijk te krijgen.

Privacy — je gescande documenten blijven privé

Gescande documenten bevatten vaak gevoelige inhoud — contracten, medische dossiers, persoonlijke brieven, belastingformulieren. Bij PDFree wordt nooit iets geüpload. De OCR-engine (Tesseract.js) wordt eenmalig gedownload en draait daarna volledig in je browsertab. Er zijn geen servers die je bestanden ontvangen, geen cloudopslag en geen enkele vorm van gegevensverzameling. Open DevTools → tabblad Netwerk tijdens de verwerking om het zelf te controleren: nul uploads.

Gebruik PDFree OCR offline

Zodra de Tesseract.js-engine bij je eerste OCR-run is gedownload (~17 MB, gecached door je browser), werkt PDFree OCR volledig offline. Er is geen internetverbinding nodig om volgende documenten te verwerken — ideaal voor omgevingen met beperkte netwerktoegang, zoals advocatenkantoren, medische instellingen of het beoordelen van vertrouwelijke documenten.

PDFree OCR versus gangbare online OCR-tools

Functie PDFree Gangbare online OCR
Bestandsverwerking In je browser — alleen lokaal Bestand wordt geüpload naar een server
Taalselectie Automatisch herkend uit het document Handmatig, snel verkeerd gekozen
Account vereist Nee Vaak vereist
Uitvoer Doorzoekbare PDF + optioneel .txt Bij veel tools alleen .txt
Originele lay-out Exact behouden Vaak opnieuw opgemaakt
Werkt offline Ja, na de eerste keer laden Nee

Een gescande PDF omzetten naar bewerkbare tekst

Om een gescande PDF om te zetten naar bewerkbare tekst, gebruik je PDFree in twee stappen: voer eerst OCR uit om een doorzoekbare PDF te maken (hierboven), en open het resultaat vervolgens in PDF naar Word — de tool zet de ingesloten tekstlaag om in een volledig bewerkbaar .docx-document. Het hele proces verloopt lokaal; je document wordt nergens geüpload.

Veelgestelde vragen

Is deze OCR-tool echt gratis?

Ja, volledig gratis. Geen abonnement, geen premiumniveau, geen kosten per bestand. De OCR-engine (Tesseract.js) is open source en draait volledig in je browser.

Bewaart of registreert PDFree mijn bestanden na verwerking?

Nee. PDFree heeft geen backend-server die je bestanden ontvangt, dus er kan niets worden opgeslagen, geregistreerd of bewaard. Je PDF en de herkende tekst bestaan alleen in het geheugen van je browser tijdens de sessie en worden gewist zodra je het tabblad sluit.

Wordt mijn bestand naar een server geüpload?

Nooit. Alle verwerking gebeurt in je browsertab. Je PDF-bestand verlaat nooit je apparaat — geen server ontvangt het ooit. De Tesseract.js-engine wordt eenmalig gedownload van een CDN en gecached; daarna werkt hij volledig offline.

Hoe werkt de automatische taaldetectie?

PDFree analyseert tekst van je gescande pagina's en stelt de meest waarschijnlijke documenttaal voor voordat de OCR draait — je hoeft het niet vooraf te weten. Dit werkt onafhankelijk van de interfacetaal van de site. Je kunt de suggestie altijd overschrijven via het dropdownmenu.

Welke talen worden ondersteund?

18 talen: Engels, Frans, Duits, Spaans, Italiaans, Portugees, Russisch, Oezbeeks, Nederlands, Pools, Turks, Arabisch, Japans, Chinees (vereenvoudigd en traditioneel), Koreaans, Hindi en Thais.

Ziet de PDF er anders uit na OCR?

Nee. PDFree voegt een onzichtbare tekstlaag toe boven je originele gescande pagina's. Het uiterlijk verandert niet — afbeeldingen, lay-out en opmaak blijven exact hetzelfde.

Waarom wordt mijn OCR-kwaliteit als Matig of Slecht beoordeeld?

De OCR-nauwkeurigheid hangt af van de kwaliteit van de originele scan. Lage resolutie (onder 150 DPI), wazige of scheve pagina's, gekleurde achtergronden en handschrift verlagen allemaal de betrouwbaarheidsscore. Voor de beste resultaten: scan op 300 DPI of hoger met goede verlichting.

Wat is de maximale bestandsgrootte?

PDFree OCR ondersteunt bestanden tot 200 MB. Op mobiel (iOS/iPadOS) is de verwerking beperkt tot de eerste 30 pagina's om geheugenproblemen te voorkomen — splits de PDF eerst om de rest te verwerken. Geen limieten op desktopbrowsers.

Werkt het offline?

Ja. Zodra de Tesseract.js-engine bij je eerste OCR-run is gedownload, werkt PDFree volledig offline als Progressive Web App.

Gerelateerde tools

  • PDF naar Word — zet je doorzoekbare PDF om in een bewerkbaar Word-document
  • PDF splitsen — splits een groot gescand document vóór OCR om binnen geheugenlimieten te blijven
  • PDF comprimeren — verklein je gescande PDF voordat je hem deelt of archiveert
  • PDF samenvoegen — combineer meerdere gescande pagina's tot één PDF
  • PDF zwartmaken — verberg gevoelige gebieden voordat je deelt

Waarom PDFree in plaats van andere PDF-tools?

📁
Geen limiet op bestandsgrootte Voeg samen, comprimeer of converteer PDF-bestanden van elke grootte — 500 MB, 1 GB, geen beperkingen.
🔒
Bestanden verlaten je apparaat nooit Alles werkt in de browser. Geen upload, geen server, geen blootstelling van gegevens — ook offline.
👤
Geen account vereist Geen registratie, geen e-mail, geen inloggen. Open de pagina en gebruik de tool.
🚫
Geen watermerk toegevoegd Uitvoerbestanden zijn schoon. Geen branding, geen watermerk, geen verborgen tekstlagen.
♾️
Geen dagelijkse limieten Gebruik zo vaak als nodig. Geen dagelijkse of maandelijkse quota, geen premium-abonnement.
🆓
Voor altijd gratis Geen gratis proefversie, geen freemium. PDFree is volledig gratis — open source onder AGPLv3.