PDF Tekstherkenning
Haal tekst uit gescande PDF's en maak ze doorzoekbaar. Detecteert automatisch de documenttaal. 100% lokaal — niets wordt geüpload.
Haal tekst uit gescande PDF's en maak ze doorzoekbaar. Detecteert automatisch de documenttaal. 100% lokaal — niets wordt geüpload.
Haal tekst uit gescande PDF's, maak ze doorzoekbaar en kopieer de inhoud — rechtstreeks in je browser met OCR (optische tekenherkenning). Geen software om te installeren, geen account nodig, en je bestanden verlaten nooit je apparaat.
PDFree detecteert automatisch de taal van je document voordat de OCR start, dus je hoeft niet te raden. Werkt met gescande contracten, studieboeken, facturen en archiefdocumenten in tientallen talen en schriften.
Sleep het bestand of klik op "PDF kiezen". PDFree detecteert automatisch of je PDF al een tekstlaag heeft of gewoon een gescande afbeelding is.
Voor gescande PDF's: klik op OCR-engine installeren om Tesseract.js te laden (~17 MB, eenmalige download). PDFree analyseert de pagina en stelt automatisch de documenttaal voor; je kunt dit wijzigen via het dropdownmenu indien nodig. PDF's met een tekstlaag slaan deze stap over.
De herkenningsmachine verwerkt elke pagina lokaal — er wordt niets geüpload. Een voortgangsbalk toont de geschatte resterende tijd.
Je PDF wordt automatisch gedownload zodra de tekstherkenning klaar is. Het originele uiterlijk verandert niet; er wordt alleen een onzichtbare tekstlaag toegevoegd zodat je in elke PDF-lezer kunt zoeken, selecteren en tekst kopiëren.
OCR is handig zodra je een document als afbeelding hebt en met de tekst erin moet werken:
PDFree detecteert automatisch welk type PDF je hebt. PDF's met een tekstlaag (de meeste digitaal gemaakte PDF's — uit Word, Google Docs of andere moderne apps) bevatten al machine-leesbare tekst — extractie is direct en er is geen OCR-engine nodig. Gescande PDF's (foto's van pagina's, faxen, oude archiefscans) bevatten alleen afbeeldingen en hebben OCR nodig om pixels om te zetten in selecteerbare, doorzoekbare tekst.
De meeste OCR-tools verplichten je vooraf de documenttaal te kiezen, en een verkeerde keuze verpest stilletjes de nauwkeurigheid. PDFree analyseert in plaats daarvan de inhoud van de pagina en stelt automatisch de juiste taal voor — een echt onderscheidende functie, omdat de herkenningsengine onafhankelijk werkt van welke van de 6 PDFree-interfacetalen je gebruikt. Lees je een scan in het Russisch, Japans of Turks terwijl je de Nederlandse interface gebruikt? De detectie vindt nog steeds de echte taal van het document. Je kunt de suggestie altijd handmatig overschrijven.
PDFree gebruikt Tesseract.js, een toonaangevende open-source tekstherkenningsengine, en ondersteunt 18 talen: Engels, Frans, Duits, Spaans, Italiaans, Portugees, Russisch, Oezbeeks, Nederlands, Pools, Turks (Europese schriften) en Arabisch, Japans, Chinees vereenvoudigd, Chinees traditioneel, Koreaans, Hindi, Thais (complexe schriften).
De doorzoekbare PDF behoudt je originele gescande afbeeldingen exact en voegt er een onzichtbare tekstlaag aan toe — handig voor archivering, zoeken in een PDF-lezer of delen. Het .txt-bestand bevat alleen de geëxtraheerde platte tekst met paginascheidingen — handig om te bewerken in Word of te importeren in een andere tool. Schakel "Ook .txt-kopie downloaden" in om beide bestanden tegelijk te krijgen.
Gescande documenten bevatten vaak gevoelige inhoud — contracten, medische dossiers, persoonlijke brieven, belastingformulieren. Bij PDFree wordt nooit iets geüpload. De OCR-engine (Tesseract.js) wordt eenmalig gedownload en draait daarna volledig in je browsertab. Er zijn geen servers die je bestanden ontvangen, geen cloudopslag en geen enkele vorm van gegevensverzameling. Open DevTools → tabblad Netwerk tijdens de verwerking om het zelf te controleren: nul uploads.
Zodra de Tesseract.js-engine bij je eerste OCR-run is gedownload (~17 MB, gecached door je browser), werkt PDFree OCR volledig offline. Er is geen internetverbinding nodig om volgende documenten te verwerken — ideaal voor omgevingen met beperkte netwerktoegang, zoals advocatenkantoren, medische instellingen of het beoordelen van vertrouwelijke documenten.
| Functie | PDFree | Gangbare online OCR |
|---|---|---|
| Bestandsverwerking | In je browser — alleen lokaal | Bestand wordt geüpload naar een server |
| Taalselectie | Automatisch herkend uit het document | Handmatig, snel verkeerd gekozen |
| Account vereist | Nee | Vaak vereist |
| Uitvoer | Doorzoekbare PDF + optioneel .txt | Bij veel tools alleen .txt |
| Originele lay-out | Exact behouden | Vaak opnieuw opgemaakt |
| Werkt offline | Ja, na de eerste keer laden | Nee |
Om een gescande PDF om te zetten naar bewerkbare tekst, gebruik je PDFree in twee stappen: voer eerst OCR uit om een doorzoekbare PDF te maken (hierboven), en open het resultaat vervolgens in PDF naar Word — de tool zet de ingesloten tekstlaag om in een volledig bewerkbaar .docx-document. Het hele proces verloopt lokaal; je document wordt nergens geüpload.
Ja, volledig gratis. Geen abonnement, geen premiumniveau, geen kosten per bestand. De OCR-engine (Tesseract.js) is open source en draait volledig in je browser.
Nee. PDFree heeft geen backend-server die je bestanden ontvangt, dus er kan niets worden opgeslagen, geregistreerd of bewaard. Je PDF en de herkende tekst bestaan alleen in het geheugen van je browser tijdens de sessie en worden gewist zodra je het tabblad sluit.
Nooit. Alle verwerking gebeurt in je browsertab. Je PDF-bestand verlaat nooit je apparaat — geen server ontvangt het ooit. De Tesseract.js-engine wordt eenmalig gedownload van een CDN en gecached; daarna werkt hij volledig offline.
PDFree analyseert tekst van je gescande pagina's en stelt de meest waarschijnlijke documenttaal voor voordat de OCR draait — je hoeft het niet vooraf te weten. Dit werkt onafhankelijk van de interfacetaal van de site. Je kunt de suggestie altijd overschrijven via het dropdownmenu.
18 talen: Engels, Frans, Duits, Spaans, Italiaans, Portugees, Russisch, Oezbeeks, Nederlands, Pools, Turks, Arabisch, Japans, Chinees (vereenvoudigd en traditioneel), Koreaans, Hindi en Thais.
Nee. PDFree voegt een onzichtbare tekstlaag toe boven je originele gescande pagina's. Het uiterlijk verandert niet — afbeeldingen, lay-out en opmaak blijven exact hetzelfde.
De OCR-nauwkeurigheid hangt af van de kwaliteit van de originele scan. Lage resolutie (onder 150 DPI), wazige of scheve pagina's, gekleurde achtergronden en handschrift verlagen allemaal de betrouwbaarheidsscore. Voor de beste resultaten: scan op 300 DPI of hoger met goede verlichting.
PDFree OCR ondersteunt bestanden tot 200 MB. Op mobiel (iOS/iPadOS) is de verwerking beperkt tot de eerste 30 pagina's om geheugenproblemen te voorkomen — splits de PDF eerst om de rest te verwerken. Geen limieten op desktopbrowsers.
Ja. Zodra de Tesseract.js-engine bij je eerste OCR-run is gedownload, werkt PDFree volledig offline als Progressive Web App.