PDF Metin Tanıma
Taranan PDF'lerden metin çıkarın ve aranabilir hale getirin. Belge dilini otomatik algılar. %100 yerel — yükleme yok.
Taranan PDF'lerden metin çıkarın ve aranabilir hale getirin. Belge dilini otomatik algılar. %100 yerel — yükleme yok.
Taranan PDF'lerden metin çıkarın, aranabilir hale getirin ve içeriği kopyalayın — OCR (Optik Karakter Tanıma) ile doğrudan tarayıcınızda. Yazılım kurmaya gerek yok, hesap gerekmiyor ve dosyalarınız hiçbir zaman cihazınızdan çıkmıyor.
PDFree, OCR'ı çalıştırmadan önce belgenizin dilini otomatik olarak algılar, bu yüzden tahmin etmenize gerek yok. Taranan sözleşmeler, ders kitapları, faturalar ve arşiv belgeleri için onlarca dil ve alfabede çalışır.
Dosyayı sürükleyip bırakın veya "PDF Seç"e tıklayın. PDFree, PDF'inizin zaten bir metin katmanı olup olmadığını veya sadece taranmış bir görüntü olup olmadığını otomatik olarak algılar.
Taranan PDF'ler için: Tesseract.js'i yüklemek üzere OCR Motorunu Yükle'ye tıklayın (~17 MB, tek seferlik indirme). PDFree sayfayı analiz eder ve belge dilini otomatik olarak önerir; gerekirse açılır menüden değiştirebilirsiniz. Metin katmanı olan PDF'ler bu adımı atlar.
Tanıma motoru her sayfayı yerel olarak işler — hiçbir şey yüklenmez. Bir ilerleme çubuğu tahmini kalan süreyi gösterir.
Metin tanıma tamamlandığında PDF'iniz otomatik olarak indirilir. Orijinal görünüm değişmez; herhangi bir PDF okuyucusunda metni arayabilmeniz, seçebilmeniz ve kopyalayabilmeniz için yalnızca görünmez bir metin katmanı eklenir.
Görüntü biçiminde bir belgeniz olduğunda ve içindeki metinle çalışmanız gerektiğinde OCR faydalıdır:
PDFree hangi tür PDF'e sahip olduğunuzu otomatik olarak algılar. Metin katmanına sahip PDF'ler (Word, Google Docs veya başka bir modern uygulamadan dijital olarak oluşturulan çoğu PDF) zaten makine tarafından okunabilir metin içerir — çıkarma anında gerçekleşir, OCR motoruna gerek yoktur. Taranan PDF'ler (sayfa fotoğrafları, fakslar, eski arşiv taramaları) yalnızca görüntü içerir ve pikselleri seçilebilir, aranabilir metne dönüştürmek için OCR gerektirir.
Çoğu OCR aracı, belge dilini önceden seçmenizi zorunlu kılar ve yanlış seçim sessizce doğruluğu bozar. PDFree bunun yerine sayfa içeriğini analiz eder ve doğru dili otomatik olarak önerir — bu, gerçekten ayırt edici bir özelliktir, çünkü tanıma motoru PDFree'nin 6 arayüz dilinden hangisini kullandığınızdan bağımsız olarak çalışır. Türkçe arayüzü kullanırken Rusça, Japonca veya İspanyolca bir tarama mı okuyorsunuz? Algılama yine de belgenin gerçek dilini bulur. Öneriyi her zaman manuel olarak değiştirebilirsiniz.
PDFree, açık kaynaklı önde gelen metin tanıma motoru Tesseract.js'i kullanır ve 18 dili destekler: İngilizce, Fransızca, Almanca, İspanyolca, İtalyanca, Portekizce, Rusça, Özbekçe, Felemenkçe, Lehçe, Türkçe (Avrupa alfabeleri) ve Arapça, Japonca, Basitleştirilmiş Çince, Geleneksel Çince, Korece, Hintçe, Tayca (karmaşık yazı sistemleri).
Aranabilir PDF, orijinal taranmış görüntülerinizi tam olarak korur ve üzerine görünmez bir metin katmanı ekler — arşivleme, bir PDF okuyucusu içinde arama yapma veya paylaşma için kullanışlıdır. .txt dosyası yalnızca sayfa ayırıcılarıyla çıkarılmış düz metni içerir — Word'de düzenlemek veya başka bir araca aktarmak için kullanışlıdır. Her iki dosyayı aynı anda almak için "Ayrıca .txt kopyası indir" seçeneğini etkinleştirin.
Taranan belgeler genellikle hassas içerik barındırır — sözleşmeler, tıbbi kayıtlar, kişisel mektuplar, vergi formları. PDFree ile hiçbir şey asla yüklenmez. OCR motoru (Tesseract.js) yalnızca bir kez indirilir ve ardından tamamen tarayıcı sekmenizin içinde çalışır. Dosyalarınızı alan sunucu, bulut depolama veya herhangi bir türde veri toplama yoktur. İşlem sırasında DevTools → Ağ sekmesini açarak kendiniz doğrulayabilirsiniz: sıfır yükleme.
İlk OCR çalıştırmanızda Tesseract.js motoru indirildikten sonra (~17 MB, tarayıcınız tarafından önbelleğe alınır), PDFree OCR tamamen çevrimdışı çalışır. Sonraki belgeleri işlemek için internet bağlantısına gerek yoktur — hukuk büroları, tıbbi tesisler veya gizli belge incelemesi gibi ağ erişiminin kısıtlı olduğu ortamlar için idealdir.
Taranan bir PDF'i düzenlenebilir metne dönüştürmek için PDFree'yi iki adımda kullanın: önce aranabilir bir PDF oluşturmak için OCR'ı çalıştırın (yukarıda), ardından sonucu PDF'den Word'e aracında açın — bu araç, gömülü metin katmanını tamamen düzenlenebilir bir .docx belgesine dönüştürür. Tüm işlem yerel olarak gerçekleşir; belgeniz hiçbir yere yüklenmez.
Evet, tamamen ücretsiz. Abonelik yok, premium katman yok, dosya başına ücret yok. OCR motoru (Tesseract.js) açık kaynaklıdır ve tamamen tarayıcınızda çalışır.
Hayır. PDFree'nin dosyalarınızı alan bir arka uç sunucusu yoktur, bu yüzden hiçbir şey saklanamaz, kaydedilemez veya tutulamaz. PDF'iniz ve tanınan metin yalnızca oturum boyunca tarayıcınızın belleğinde bulunur ve sekmeyi kapattığınızda silinir.
Asla. Tüm işlem tarayıcı sekmenizin içinde gerçekleşir. PDF dosyanız hiçbir zaman cihazınızdan çıkmaz — hiçbir sunucu onu almaz. Tesseract.js motoru bir CDN'den bir kez indirilir ve önbelleğe alınır; sonrasında tamamen çevrimdışı çalışır.
PDFree, taranan sayfalarınızdan metni analiz eder ve OCR'ı çalıştırmadan önce belgenin en olası dilini önerir — önceden bilmenize gerek yoktur. Bu, sitenin arayüz dilinden bağımsız olarak çalışır. Öneriyi her zaman açılır menüden değiştirebilirsiniz.
18 dil: İngilizce, Fransızca, Almanca, İspanyolca, İtalyanca, Portekizce, Rusça, Özbekçe, Felemenkçe, Lehçe, Türkçe, Arapça, Japonca, Çince (Basitleştirilmiş ve Geleneksel), Korece, Hintçe ve Tayca.
Hayır. PDFree, orijinal taranmış sayfalarınızın üzerine görünmez bir metin katmanı ekler. Görünüm değişmez — görüntüler, düzen ve biçimlendirme tam olarak aynı kalır.
OCR doğruluğu orijinal tarama kalitesine bağlıdır. Düşük çözünürlük (150 DPI altı), bulanık veya eğik sayfalar, renkli arka planlar ve el yazısı, güven puanını düşürür. En iyi sonuçlar için: 300 DPI veya üzerinde, iyi aydınlatmayla tarayın.
PDFree OCR, 200 MB'a kadar dosyaları destekler. Mobilde (iOS/iPadOS), bellek sorunlarını önlemek için işlem ilk 30 sayfayla sınırlıdır — geri kalanını işlemek için önce PDF'i bölün. Masaüstü tarayıcılarında sınır yoktur.
Evet. İlk OCR çalıştırmanızda Tesseract.js motoru indirildikten sonra, PDFree bir Progressive Web App olarak tamamen çevrimdışı çalışır.