Riconosci Testo PDF
Estrai il testo dai PDF scansionati e rendili ricercabili. Rileva automaticamente la lingua del documento. 100% locale — nessun caricamento.
Estrai il testo dai PDF scansionati e rendili ricercabili. Rileva automaticamente la lingua del documento. 100% locale — nessun caricamento.
Estrai il testo da PDF scansionati, rendili ricercabili e copia i contenuti — direttamente nel tuo browser con l'OCR (riconoscimento ottico dei caratteri). Nessun software da installare, nessun account richiesto, e i tuoi file non lasciano mai il tuo dispositivo.
PDFree rileva automaticamente la lingua del tuo documento prima di eseguire l'OCR, quindi non devi indovinare. Funziona con contratti scansionati, libri di testo, fatture e documenti d'archivio in decine di lingue e alfabeti.
Trascina il file oppure clicca su "Scegli PDF". PDFree rileva automaticamente se il tuo PDF ha già uno strato di testo o è solo un'immagine scansionata.
Per i PDF scansionati: clicca su Installa motore OCR per caricare Tesseract.js (~17 MB, download una tantum). PDFree analizza la pagina e suggerisce automaticamente la lingua del documento; puoi cambiarla dal menu a tendina se necessario. I PDF con strato di testo saltano questo passaggio.
Il motore di riconoscimento elabora ogni pagina localmente — nulla viene caricato. Una barra di avanzamento mostra il tempo stimato rimanente.
Il tuo PDF si scarica automaticamente al termine del riconoscimento del testo. L'aspetto originale non cambia; viene aggiunto solo uno strato di testo invisibile così puoi cercare, selezionare e copiare testo in qualsiasi lettore PDF.
L'OCR è utile ogni volta che hai un documento sotto forma di immagine e devi lavorare con il testo che contiene:
PDFree rileva automaticamente il tipo di PDF che hai. I PDF con strato di testo (la maggior parte dei PDF creati digitalmente da Word, Google Docs o altre app moderne) contengono già testo leggibile dalla macchina — l'estrazione è istantanea e non serve un motore OCR. I PDF scansionati (foto di pagine, fax, vecchie scansioni d'archivio) contengono solo immagini e richiedono l'OCR per convertire i pixel in testo selezionabile e ricercabile.
La maggior parte degli strumenti OCR ti obbliga a scegliere la lingua del documento in anticipo, e sbagliare peggiora silenziosamente la precisione. PDFree invece analizza il contenuto della pagina e suggerisce automaticamente la lingua corretta — una funzione davvero distintiva, perché il motore di riconoscimento funziona indipendentemente da quale delle 6 lingue dell'interfaccia di PDFree stai usando. Stai leggendo una scansione in russo, giapponese o turco mentre usi l'interfaccia in italiano? Il rilevamento trova comunque la vera lingua del documento. Puoi sempre modificare manualmente il suggerimento.
PDFree utilizza Tesseract.js, un motore di riconoscimento del testo open source leader del settore, e supporta 18 lingue: inglese, francese, tedesco, spagnolo, italiano, portoghese, russo, uzbeko, olandese, polacco, turco (alfabeti europei) e arabo, giapponese, cinese semplificato, cinese tradizionale, coreano, hindi, thailandese (alfabeti complessi).
Il PDF ricercabile mantiene esattamente le tue immagini scansionate originali e aggiunge sopra uno strato di testo invisibile — utile per l'archiviazione, la ricerca all'interno di un lettore PDF o la condivisione. Il file .txt contiene solo il testo estratto con separatori di pagina — utile per modificare il contenuto in Word o importarlo in un altro strumento. Attiva "Scarica anche una copia .txt" per ottenere entrambi i file insieme.
I documenti scansionati contengono spesso contenuti sensibili — contratti, cartelle cliniche, lettere personali, moduli fiscali. Con PDFree non viene mai caricato nulla. Il motore OCR (Tesseract.js) viene scaricato una sola volta e poi funziona interamente all'interno della tua scheda del browser. Nessun server riceve i tuoi file, nessun archiviazione cloud, nessuna raccolta di dati di alcun tipo. Apri DevTools → scheda Rete durante l'elaborazione per verificarlo tu stesso: zero caricamenti.
Una volta scaricato il motore Tesseract.js al primo utilizzo dell'OCR (~17 MB, memorizzato nella cache dal browser), l'OCR di PDFree funziona completamente offline. Non serve una connessione internet per elaborare i documenti successivi — ideale per ambienti con accesso di rete limitato, come studi legali, strutture mediche o revisione di documenti riservati.
Per convertire un PDF scansionato in testo modificabile, usa PDFree in due passaggi: prima esegui l'OCR per creare un PDF ricercabile (sopra), poi apri il risultato in PDF in Word — lo strumento converte lo strato di testo incorporato in un documento .docx completamente modificabile. L'intero processo avviene localmente; il tuo documento non viene mai caricato da nessuna parte.
Sì, completamente gratuito. Nessun abbonamento, nessun livello premium, nessun costo per file. Il motore OCR (Tesseract.js) è open source e funziona interamente nel tuo browser.
No. PDFree non ha alcun server backend che riceve i tuoi file, quindi nulla può essere memorizzato, registrato o conservato. Il tuo PDF e il testo riconosciuto esistono solo nella memoria del tuo browser durante la sessione e vengono cancellati alla chiusura della scheda.
Mai. Tutta l'elaborazione avviene all'interno della tua scheda del browser. Il tuo file PDF non lascia mai il tuo dispositivo — nessun server lo riceve mai. Il motore Tesseract.js viene scaricato una volta da un CDN e memorizzato nella cache; dopodiché funziona completamente offline.
PDFree analizza il testo dalle tue pagine scansionate e suggerisce la lingua più probabile del documento prima di eseguire l'OCR — non devi conoscerla in anticipo. Questo funziona indipendentemente dalla lingua dell'interfaccia del sito. Puoi sempre modificare il suggerimento dal menu a tendina.
18 lingue: inglese, francese, tedesco, spagnolo, italiano, portoghese, russo, uzbeko, olandese, polacco, turco, arabo, giapponese, cinese (semplificato e tradizionale), coreano, hindi e thailandese.
No. PDFree aggiunge uno strato di testo invisibile sopra le tue pagine scansionate originali. L'aspetto non cambia — immagini, layout e formattazione restano esattamente identici.
La precisione dell'OCR dipende dalla qualità della scansione originale. Bassa risoluzione (sotto i 150 DPI), pagine sfocate o storte, sfondi colorati e testo manoscritto riducono tutti il punteggio di affidabilità. Per risultati migliori: scansiona a 300 DPI o superiore con una buona illuminazione.
L'OCR di PDFree supporta file fino a 200 MB. Su mobile (iOS/iPadOS), l'elaborazione è limitata alle prime 30 pagine — dividi prima il PDF per elaborare il resto. Nessun limite sui browser desktop.
Sì. Una volta scaricato il motore Tesseract.js al primo utilizzo dell'OCR, PDFree funziona completamente offline come Progressive Web App.