Rozpoznaj Tekst PDF
Rozpoznaj tekst w zeskanowanych plikach PDF i spraw, by dało się go wyszukiwać. Automatycznie wykrywa język dokumentu. 100% lokalnie — bez przesyłania.
Rozpoznaj tekst w zeskanowanych plikach PDF i spraw, by dało się go wyszukiwać. Automatycznie wykrywa język dokumentu. 100% lokalnie — bez przesyłania.
Wyodrębnij tekst z zeskanowanych plików PDF, spraw, by można było go wyszukiwać, i skopiuj treść — bezpośrednio w przeglądarce dzięki OCR (optycznemu rozpoznawaniu znaków). Bez instalowania oprogramowania, bez konta, a Twoje pliki nigdy nie opuszczają Twojego urządzenia.
PDFree automatycznie wykrywa język dokumentu przed uruchomieniem OCR, więc nie musisz zgadywać. Działa ze zeskanowanymi umowami, podręcznikami, fakturami i dokumentami archiwalnymi w dziesiątkach języków i alfabetów.
Przeciągnij plik lub kliknij „Wybierz PDF". PDFree automatycznie sprawdza, czy Twój PDF ma już warstwę tekstu, czy jest czystym obrazem ze skanera.
Dla zeskanowanych PDF-ów: kliknij Zainstaluj silnik OCR, aby wczytać Tesseract.js (~17 MB, jednorazowe pobranie). PDFree analizuje stronę i automatycznie sugeruje język dokumentu; możesz go zmienić w rozwijanym menu, jeśli trzeba. PDF-y z warstwą tekstu pomijają ten krok.
Silnik rozpoznawania przetwarza każdą stronę lokalnie — nic nie jest przesyłane. Pasek postępu pokazuje szacowany pozostały czas.
Twój PDF pobiera się automatycznie po zakończeniu rozpoznawania tekstu. Oryginalny wygląd się nie zmienia; dodawana jest tylko niewidoczna warstwa tekstu, dzięki czemu możesz wyszukiwać, zaznaczać i kopiować tekst w dowolnym czytniku PDF.
OCR jest przydatne zawsze, gdy masz dokument w postaci obrazu i musisz pracować z zawartym w nim tekstem:
PDFree automatycznie wykrywa, jaki typ PDF-a masz. PDF-y z warstwą tekstu (większość PDF-ów tworzonych cyfrowo — z Worda, Google Docs lub innej nowoczesnej aplikacji) już zawierają tekst czytelny maszynowo — ekstrakcja jest natychmiastowa, bez potrzeby silnika OCR. Zeskanowane PDF-y (zdjęcia stron, faksy, stare skany archiwalne) zawierają tylko obrazy i wymagają OCR, aby zamienić piksele w zaznaczalny, przeszukiwalny tekst.
Większość narzędzi OCR zmusza do wyboru języka dokumentu z góry, a błędny wybór po cichu psuje dokładność. PDFree zamiast tego analizuje treść strony i automatycznie sugeruje właściwy język — naprawdę wyróżniająca się funkcja, ponieważ silnik rozpoznawania działa niezależnie od tego, którego z 6 języków interfejsu PDFree używasz. Czytasz skan po rosyjsku, japońsku lub turecku, korzystając z polskiego interfejsu? Wykrywanie i tak znajdzie prawdziwy język dokumentu. Zawsze możesz ręcznie zmienić sugestię.
PDFree korzysta z Tesseract.js, wiodącego silnika rozpoznawania tekstu o otwartym kodzie źródłowym, i obsługuje 18 języków: angielski, francuski, niemiecki, hiszpański, włoski, portugalski, rosyjski, uzbecki, niderlandzki, polski, turecki (alfabety europejskie) oraz arabski, japoński, chiński uproszczony, chiński tradycyjny, koreański, hindi, tajski (złożone systemy pisma).
Przeszukiwalny PDF zachowuje oryginalne zeskanowane obrazy dokładnie takie, jakie były, i dodaje nad nimi niewidoczną warstwę tekstu — przydatne do archiwizacji, wyszukiwania w czytniku PDF lub udostępniania. Plik .txt zawiera tylko wyodrębniony zwykły tekst z separatorami stron — przydatne do edycji w Wordzie lub importu do innego narzędzia. Włącz „Pobierz też kopię .txt", aby uzyskać oba pliki jednocześnie.
Zeskanowane dokumenty często zawierają wrażliwą treść — umowy, dokumentację medyczną, prywatną korespondencję, formularze podatkowe. Dzięki PDFree nic nigdy nie jest przesyłane. Silnik OCR (Tesseract.js) jest pobierany jednorazowo, a następnie działa całkowicie wewnątrz karty przeglądarki. Nie ma serwerów odbierających Twoje pliki, żadnego przechowywania w chmurze i żadnego zbierania danych. Otwórz DevTools → zakładkę Sieć podczas przetwarzania, aby samodzielnie to sprawdzić: zero przesyłań.
Gdy silnik Tesseract.js zostanie pobrany przy pierwszym uruchomieniu OCR (~17 MB, buforowane przez przeglądarkę), OCR PDFree działa całkowicie offline. Do przetwarzania kolejnych dokumentów nie jest potrzebne połączenie internetowe — idealne dla środowisk o ograniczonym dostępie do sieci: kancelarii prawnych, placówek medycznych czy przeglądu poufnych dokumentów.
Aby zamienić zeskanowany PDF na edytowalny tekst, użyj PDFree w dwóch krokach: najpierw uruchom OCR, aby utworzyć przeszukiwalny PDF (powyżej), a następnie otwórz wynik w PDF do Word — narzędzie zamienia wbudowaną warstwę tekstu w w pełni edytowalny dokument .docx. Cały proces przebiega lokalnie; Twój dokument nigdy nigdzie nie jest przesyłany.
Tak, całkowicie darmowe. Bez subskrypcji, bez poziomu premium, bez opłat za plik. Silnik OCR (Tesseract.js) jest open source i działa w całości w Twojej przeglądarce.
Nie. PDFree nie ma żadnego serwera backendowego, który odbierałby Twoje pliki, więc nic nie może zostać zapisane, zalogowane ani zachowane. Twój PDF i rozpoznany tekst istnieją tylko w pamięci przeglądarki przez czas sesji i są usuwane po zamknięciu karty.
Nigdy. Całe przetwarzanie odbywa się w karcie przeglądarki. Twój plik PDF nigdy nie opuszcza urządzenia — żaden serwer go nie otrzymuje. Silnik Tesseract.js jest pobierany jednorazowo z CDN i buforowany; potem działa całkowicie offline.
PDFree analizuje tekst z zeskanowanych stron i sugeruje najbardziej prawdopodobny język dokumentu przed uruchomieniem OCR — nie musisz znać go z góry. Działa to niezależnie od języka interfejsu strony. Zawsze możesz zmienić sugestię w rozwijanym menu.
18 języków: angielski, francuski, niemiecki, hiszpański, włoski, portugalski, rosyjski, uzbecki, niderlandzki, polski, turecki, arabski, japoński, chiński (uproszczony i tradycyjny), koreański, hindi i tajski.
Nie. PDFree dodaje niewidoczną warstwę tekstu nad oryginalnymi zeskanowanymi stronami. Wygląd się nie zmienia — obrazy, układ i formatowanie pozostają dokładnie takie same.
Dokładność OCR zależy od jakości oryginalnego skanu. Niska rozdzielczość (poniżej 150 DPI), rozmyte lub przekrzywione strony, kolorowe tła i pismo odręczne obniżają wynik pewności. Dla najlepszych efektów: skanuj w 300 DPI lub wyżej, przy dobrym oświetleniu.
OCR PDFree obsługuje pliki do 200 MB. Na urządzeniach mobilnych (iOS/iPadOS) przetwarzanie jest ograniczone do pierwszych 30 stron — najpierw podziel PDF, aby przetworzyć resztę. Brak limitów w przeglądarkach desktopowych.
Tak. Gdy silnik Tesseract.js zostanie pobrany przy pierwszym uruchomieniu OCR, PDFree działa całkowicie offline jako Progressive Web App.