OCR PDF

Text aus gescannten PDFs erkennen und durchsuchbar machen. Erkennt automatisch die Dokumentsprache. 100% lokal — kein Upload.

✓ Kein Dateigrößenlimit ✓ Kein Konto erforderlich ✓ Kein Wasserzeichen ✓ Für immer kostenlos
Dateien hier ablegen
oder durchsuchen — beliebig viele Dateien
Deine Datei verlässt deinen Browser nie — lokal verarbeitet, kein Upload

PDF OCR Kostenlos — Gescannte PDFs Durchsuchbar Machen

Extrahiere Text aus gescannten PDFs, mache sie durchsuchbar und kopiere Inhalte — direkt im Browser mit OCR (optische Zeichenerkennung). Keine Software-Installation, kein Konto nötig, und deine Dateien verlassen niemals dein Gerät.

PDFree erkennt die Sprache deines Dokuments automatisch, bevor die Texterkennung startet — du musst nicht raten. Funktioniert bei gescannten Verträgen, Lehrbüchern, Rechnungen und Archivdokumenten in Dutzenden Sprachen und Schriftsystemen.

Was ist OCR? OCR (optische Zeichenerkennung) verwandelt ein Bild-PDF — ein gescanntes Dokument, bei dem jede Seite ein Foto ist — in ein durchsuchbares PDF, indem eine unsichtbare Textebene über die Originalbilder gelegt wird. PDFree führt OCR vollständig im Browser mit Tesseract.js aus; deine Datei wird nie auf einen Server hochgeladen. Das ursprüngliche Erscheinungsbild des Dokuments bleibt exakt erhalten.

So machst du ein gescanntes PDF durchsuchbar

1
Öffne dein gescanntes PDF

Per Drag & Drop oder Klick auf „PDF auswählen". PDFree erkennt automatisch, ob dein PDF bereits eine Textebene hat oder ein reines Scan-Bild ist.

2
Sprache automatisch erkennen lassen — oder selbst wählen

Bei gescannten PDFs: Klicke auf OCR-Engine installieren, um Tesseract.js zu laden (~17 MB, einmaliger Download). PDFree analysiert die Seite und schlägt die Dokumentsprache automatisch vor; du kannst sie über das Dropdown jederzeit ändern. Bei Text-PDFs entfällt dieser Schritt.

3
Klicke auf „PDF durchsuchbar machen"

Die Texterkennung verarbeitet jede Seite lokal — nichts wird hochgeladen. Ein Fortschrittsbalken zeigt die geschätzte Restzeit.

4
Lade dein durchsuchbares PDF herunter

Dein PDF wird automatisch heruntergeladen, sobald die Texterkennung fertig ist. Das Erscheinungsbild bleibt unverändert — nur eine unsichtbare Textebene wird hinzugefügt, damit du in jedem PDF-Reader suchen, markieren und Text kopieren kannst.

Wann OCR sinnvoll ist

OCR ist immer dann nützlich, wenn ein Dokument nur als Bild vorliegt und du mit dem enthaltenen Text arbeiten musst:

Wer Typischer Einsatz
Rechtsabteilung Alte Verträge und Gerichtsdokumente aus Papierscans durchsuchen
Studierende Text aus gescannten Lehrbüchern kopieren, Passagen markieren, in Notizen übernehmen
Buchhaltung Gescannte Rechnungen und Belege für Prüfungen durchsuchbar machen
Gesundheitswesen Papierakten digitalisieren, ohne dass Daten das Gerät verlassen
Forschung Gescannte Fachartikel und Archivdokumente durchsuchbar machen
Verwaltung / HR Papierformulare archivieren und in durchsuchbare digitale Unterlagen umwandeln

Text-PDFs vs. gescannte PDFs — was ist der Unterschied?

PDFree erkennt automatisch, welchen PDF-Typ du hast. Text-PDFs (die meisten digital erstellten PDFs — aus Word, Google Docs oder anderen Programmen) enthalten bereits maschinenlesbaren Text — die Extraktion ist sofort möglich, keine OCR-Engine nötig. Gescannte PDFs (Fotos von Seiten, Faxe, alte Archivscans) enthalten nur Bilder und benötigen OCR, um Pixel in auswählbaren, durchsuchbaren Text umzuwandeln.

Automatische Spracherkennung — kein Raten nötig

Die meisten OCR-Tools verlangen, dass du die Dokumentsprache vorher auswählst — eine falsche Wahl verschlechtert die Genauigkeit still und heimlich. PDFree analysiert stattdessen den Seiteninhalt und schlägt die richtige Sprache automatisch vor — ein wirklich eigenständiges Feature, denn die Erkennung funktioniert unabhängig davon, in welcher der 6 PDFree-Oberflächensprachen du gerade surfst. Liest du einen russischen, japanischen oder türkischen Scan, während die Oberfläche auf Deutsch eingestellt ist? Die Erkennung findet trotzdem die tatsächliche Dokumentsprache. Du kannst den Vorschlag jederzeit manuell überschreiben.

18 Sprachen unterstützt

PDFree nutzt Tesseract.js, eine führende Open-Source-Texterkennung, und unterstützt 18 Sprachen: Englisch, Französisch, Deutsch, Spanisch, Italienisch, Portugiesisch, Russisch, Usbekisch, Niederländisch, Polnisch, Türkisch (europäische Schriften) sowie Arabisch, Japanisch, Chinesisch (vereinfacht), Chinesisch (traditionell), Koreanisch, Hindi, Thailändisch (komplexe Schriften).

Was beeinflusst die OCR-Qualität?

Nach der Texterkennung zeigt PDFree einen Qualitätswert (Exzellent / Gut / Ausreichend / Schlecht) basierend auf der Wort-Konfidenz von Tesseract. Die wichtigsten Faktoren:

  • Scan-Auflösung — 300 DPI oder höher liefert die besten Ergebnisse. Unter 150 DPI werden feine Striche und kleine Schrift schwer erkennbar.
  • Seitenausrichtung — schiefe oder gedrehte Seiten verschlechtern die Genauigkeit. PDFree korrigiert die PDF-Rotation automatisch (90°/180°/270°), physische Schräglage im Scan jedoch nicht.
  • Druck- vs. Handschrift — gedruckter Text wird gut erkannt; Schreibschrift wird von Tesseract nicht unterstützt.
  • Hintergrundrauschen — farbige Hintergründe, Schatten oder Wasserzeichen verringern den Kontrast. PDFree wandelt Seiten vor der OCR in Graustufen um.
  • Sprachauswahl — die automatische Erkennung wählt meist das richtige Modell; bei mehrsprachigen Dokumenten wähle die dominante Sprache manuell für beste Ergebnisse.

Durchsuchbares PDF vs. reiner Text — was herunterladen?

Das durchsuchbare PDF behält deine ursprünglichen Scan-Bilder exakt bei und legt eine unsichtbare Textebene darüber. Öffne es in jedem PDF-Reader, markiere Text, nutze Strg+F zur Suche und kopiere Inhalte — das Erscheinungsbild bleibt unverändert. Ideal für Archivierung, Weitergabe oder Langzeitspeicherung.

Die .txt-Datei enthält nur den extrahierten Klartext mit Seitentrennern. Nutze sie, wenn du den Inhalt in Word oder Google Docs bearbeiten, in ein anderes Tool einspeisen oder programmatisch verarbeiten möchtest. Aktiviere „Auch .txt-Kopie herunterladen", um beide Dateien gleichzeitig zu erhalten.

Privatsphäre — deine gescannten Dokumente bleiben privat

Gescannte Dokumente enthalten oft sensible Inhalte — Verträge, medizinische Unterlagen, private Briefe, Steuerformulare. Bei PDFree wird nie etwas hochgeladen. Die OCR-Engine (Tesseract.js) wird einmalig heruntergeladen und läuft danach vollständig im Browser-Tab. Es gibt keine Server, die deine Dateien empfangen, keinen Cloud-Speicher und keine Datenerfassung jeglicher Art. Öffne die DevTools → Network-Tab während der Verarbeitung, um es selbst zu prüfen: null Uploads.

PDFree OCR offline nutzen

Sobald die Tesseract.js-Engine beim ersten OCR-Lauf heruntergeladen wurde (~17 MB, vom Browser zwischengespeichert), funktioniert PDFree OCR vollständig offline. Für weitere Dokumente ist keine Internetverbindung nötig — ideal für Umgebungen mit eingeschränktem Netzwerkzugang wie Anwaltskanzleien, medizinische Einrichtungen oder die Prüfung vertraulicher Dokumente. Der Service Worker speichert die App-Oberfläche zwischen, sodass sogar die UI nach dem ersten Besuch offline lädt.

PDFree OCR vs. typische Online-OCR-Tools

Merkmal PDFree Typisches Online-OCR
Dateiverarbeitung Im Browser — nur lokal Datei wird auf einen Server hochgeladen
Sprachauswahl Automatisch erkannt Manuell, leicht falsch gewählt
Konto erforderlich Nein Oft erforderlich
Ausgabe Durchsuchbares PDF + optional .txt Oft nur .txt
Ursprüngliches Layout Bleibt exakt erhalten Oft neu formatiert
Funktioniert offline Ja, nach dem ersten Laden Nein

Gescanntes PDF in bearbeitbaren Text umwandeln

Um ein gescanntes PDF in bearbeitbaren Text umzuwandeln, nutze PDFree in zwei Schritten: Führe zuerst OCR aus, um ein durchsuchbares PDF zu erstellen (siehe oben), und öffne das Ergebnis dann in PDF zu Word — das Tool wandelt die eingebettete Textebene in ein vollständig bearbeitbares .docx-Dokument um. Der gesamte Vorgang läuft lokal ab; dein Dokument wird nirgendwo hochgeladen. Für reinen Text aktiviere während der OCR die Checkbox „Auch .txt-Kopie herunterladen" und überspringe die Word-Konvertierung.

Häufig gestellte Fragen

Ist dieses OCR-Tool wirklich kostenlos?

Ja, komplett kostenlos. Kein Abo, keine Premium-Stufe, keine Kosten pro Datei. Die OCR-Engine (Tesseract.js) ist Open Source und läuft vollständig im Browser.

Speichert oder protokolliert PDFree meine Dateien nach der Verarbeitung?

Nein. PDFree hat keinen Backend-Server, der deine Dateien empfängt — daher kann nichts gespeichert, protokolliert oder aufbewahrt werden. Dein PDF und der erkannte Text existieren nur im Arbeitsspeicher deines Browsers und werden beim Schließen des Tabs gelöscht.

Wird meine Datei auf einen Server hochgeladen?

Nie. Die gesamte Verarbeitung findet im Browser-Tab statt. Deine PDF-Datei verlässt dein Gerät nie — kein Server erhält sie jemals. Die Tesseract.js-Engine wird einmalig von einem CDN geladen und zwischengespeichert; danach läuft sie vollständig offline.

Wie funktioniert die automatische Spracherkennung?

PDFree analysiert Text aus deinen gescannten Seiten und schlägt vor dem OCR-Lauf die wahrscheinlichste Dokumentsprache vor — du musst sie nicht vorher kennen. Das funktioniert unabhängig von der Oberflächensprache der Seite. Du kannst den Vorschlag jederzeit über das Dropdown überschreiben.

Welche Sprachen werden unterstützt?

18 Sprachen: Englisch, Französisch, Deutsch, Spanisch, Italienisch, Portugiesisch, Russisch, Usbekisch, Niederländisch, Polnisch, Türkisch, Arabisch, Japanisch, Chinesisch (vereinfacht/traditionell), Koreanisch, Hindi und Thailändisch.

Sieht das PDF nach der OCR anders aus?

Nein. PDFree fügt eine unsichtbare Textebene über deine gescannten Seiten ein. Das Erscheinungsbild ändert sich nicht — Bilder, Layout und Formatierung bleiben exakt erhalten. Du kannst zusätzlich in jedem PDF-Reader suchen, markieren und Text kopieren.

Warum wird meine OCR-Qualität als „Ausreichend" oder „Schlecht" bewertet?

Die OCR-Genauigkeit hängt von der Scan-Qualität ab. Niedrige Auflösung (unter 150 DPI), unscharfe oder schiefe Seiten, farbige Hintergründe und Handschrift senken den Konfidenzwert. Beste Ergebnisse: mindestens 300 DPI, gute Beleuchtung, gerade Ausrichtung und die korrekte Sprache bestätigen.

Was ist der Unterschied zwischen durchsuchbarem PDF und .txt-Datei?

Das durchsuchbare PDF behält deine gescannten Bilder bei und legt eine unsichtbare Textebene darüber — nützlich zum Archivieren, Durchsuchen im PDF-Reader oder Teilen. Die .txt-Datei enthält nur den reinen Text mit Seitentrennern — nützlich zum Bearbeiten in Word oder zum Import in andere Tools. Beide gleichzeitig herunterladen mit „Auch .txt-Kopie herunterladen".

Wie groß darf die Datei maximal sein?

PDFree OCR unterstützt Dateien bis 200 MB. Auf Mobilgeräten (iOS/iPadOS) werden nur die ersten 30 Seiten verarbeitet, um Speicherprobleme zu vermeiden — teile das PDF vorher, um den Rest zu verarbeiten. Auf Desktop-Browsern gibt es keine Grenzen.

Funktioniert es offline?

Ja. Sobald die Tesseract.js-Engine beim ersten OCR-Lauf heruntergeladen wurde, funktioniert PDFree als Progressive Web App vollständig offline — für weitere Dokumente ist keine Internetverbindung nötig.

Verwandte Tools

  • PDF zu Word — dein durchsuchbares PDF in ein bearbeitbares Word-Dokument umwandeln
  • PDF aufteilen — ein großes gescanntes Dokument vor der OCR aufteilen, um Speicherlimits einzuhalten
  • PDF komprimieren — Dateigröße deines gescannten PDFs vor dem Teilen oder Archivieren reduzieren
  • PDF zusammenführen — mehrere gescannte Seiten zu einem PDF kombinieren
  • PDF schwärzen — sensible Bereiche vor dem Teilen unkenntlich machen

Warum PDFree statt anderer PDF-Tools?

📁
Kein Dateigrößenlimit PDFs beliebiger Größe zusammenführen, komprimieren oder konvertieren — 500 MB, 1 GB, keine Einschränkungen.
🔒
Dateien verlassen dein Gerät nie Alles läuft im Browser. Kein Upload, kein Server, keine Datenweitergabe — funktioniert auch offline.
👤
Kein Konto erforderlich Keine Registrierung, keine E-Mail, keine Anmeldung. Seite öffnen und loslegen.
🚫
Kein Wasserzeichen Ausgabedateien sind sauber. Kein Branding, kein Wasserzeichen, keine versteckten Textebenen.
♾️
Keine täglichen Limits Beliebig oft nutzen. Keine Tageskontingente, keine Monatslimits, kein Premium-Druck.
🆓
Für immer kostenlos Keine Testversion, kein Freemium. PDFree ist komplett kostenlos — Open Source unter AGPLv3.