Java'da PDF Dosyasını Okuma Yöntemi
Bu makale, yazılım uygulamanızda programatik olarak bir PDF okuyucu oluşturarak bir PDF dosyasını açmayı keşfedecek. Bu görevi etkili bir şekilde gerçekleştirmek için IronPDF for Java, Java programlarında dosya adını kullanarak PDF dosyalarını açma ve okuma konusunda yardımcı olan bir sistem kütüphanesidir.
Java'da PDF Dosyaları Nasıl Okunur
- IronPDF Java Kütüphanesini İndir
fromFileyöntemini kullanarak mevcut PDF belgelerini yükleyin- PDF'lerde gömülü metni çıkarmak için
extractAllTextyöntemini çağırın - Belirli bir sayfadan metin çıkarmak için
extractTextFromPageyöntemini kullanın - URL'den işlenmiş PDF'lerden metin alın
IronPDF
IronPDF - Java Kütüphanesi, zaten başarılı olan .NET Framework üzerine inşa edilmiştir. Bu, IronPDF'yi Apache PDFBox gibi diğer sınıf kütüphaneleriyle karşılaştırıldığında PDF belgeleriyle çalışırken çok yönlü bir araç yapar. İçeriği çıkarmak ve ayrıştırmak, metni yüklemek ve görüntüleri yüklemek için olanak sağlar. Sayfa düzeni, kenar boşlukları, üstbilgi ve altbilgi, sayfa yönlendirmesi gibi PDF sayfalarını özelleştirmek için de seçenekler sunar.
Buna ek olarak, IronPDF ayrıca diğer dosya formatlarından dönüştürmeyi, PDF'leri şifre ile korumayı, dijital imzalamayı, birleştirmeyi ve PDF belgelerini bölmeyi de destekler.
Java'da PDF Dosyaları Nasıl Okunur
Ön Koşullar
Java PDF okuyucu yapmak için IronPDF'yi kullanmak amacıyla, bilgisayarda aşağıdaki bileşenlerin yüklü olması gereklidir:
- JDK - Java Geliştirme Kit'i, Java programlarını derlemek ve çalıştırmak için gereklidir. Yüklü değilse Oracle Web Sitesinden indirin.
- IDE - Entegre Geliştirme Ortamı, bir program yazmaya, düzenlemeye ve hata ayıklamaya yardımcı olan bir yazılımdır. Java için herhangi bir IDE indirin, örneğin Eclipse, NetBeans, IntelliJ.
- Maven - Maven, kütüphaneleri Merkezi Depo'dan indirmeye yardımcı olan bir otomasyon aracıdır. Apache Maven Web Sitesinden indirin.
- IronPDF - Son olarak, Java'da PDF dosyasını okumak için IronPDF gereklidir. Bu, Java Maven Projenize bir bağımlılık olarak eklenmelidir. Aşağıdaki örnekte gösterildiği gibi
pom.xmldosyasına IronPDF artefaktını ve slf4j bağımlılığını dahil edin:
<dependencies>
<dependency>
<groupId>com.ironsoftware</groupId>
<artifactId>ironpdf</artifactId>
<version>your-version-here</version>
</dependency>
<dependency>
<groupId>org.slf4j</groupId>
<artifactId>slf4j-api</artifactId>
<version>1.7.32</version>
</dependency>
</dependencies>
<dependencies>
<dependency>
<groupId>com.ironsoftware</groupId>
<artifactId>ironpdf</artifactId>
<version>your-version-here</version>
</dependency>
<dependency>
<groupId>org.slf4j</groupId>
<artifactId>slf4j-api</artifactId>
<version>1.7.32</version>
</dependency>
</dependencies>
Gerekli İthalatları Eklemek
Öncelikle, IronPDF'den gerekli tüm yöntemleri referans almak için Java kaynak dosyasının üstüne aşağıdaki kodu ekleyin:
import com.ironsoftware.ironpdf.*;
// Necessary imports from IronPDF library
import com.ironsoftware.ironpdf.*;
// Necessary imports from IronPDF library
Sonra, IronPDF'yi etkin bir lisans anahtarı ile yapılandırarak yöntemlerini kullanın. Ana metotta setLicenseKey metodunu çağırın.
License.setLicenseKey("Your license key");
// Set your IronPDF license key - required for full version
License.setLicenseKey("Your license key");
// Set your IronPDF license key - required for full version
Not: PDF oluşturmak, okumak ve yazdırmak için ücretsiz deneme lisans anahtarı alabilirsiniz.
Java'da Mevcut PDF Dosyasını Okuyun
PDF dosyalarını okumak için PDF dosyaları olmalıdır veya bir tane oluşturulabilir. Bu makalede, zaten oluşturulmuş bir PDF dosyası kullanılacak. Kod basit ve dökümandan metin çıkarmak için iki adımlık bir süreçtir:
// Load the PDF document from file
PdfDocument pdf = PdfDocument.fromFile(Paths.get("assets/sample.pdf"));
// Extract all text from the PDF
String text = pdf.extractAllText();
// Print the extracted text
System.out.println(text);
// Load the PDF document from file
PdfDocument pdf = PdfDocument.fromFile(Paths.get("assets/sample.pdf"));
// Extract all text from the PDF
String text = pdf.extractAllText();
// Print the extracted text
System.out.println(text);
Yukarıdaki kodda, fromFile bir PDF dokümanını açar. Paths.get metodu dosyanın dizinini alır ve dosyadan içerik çıkarmaya hazırdır. Ardından, extractAllText dokümandaki tüm metni okur.
Çıktı aşağıda:
PDF Metni Çıktısını Okuma
Belirli Bir Sayfadan Metin Okuma
IronPDF ayrıca bir PDF içindeki belirli bir sayfadan içerik de okuyabilir. extractTextFromPage metodu, metnin okunacağı sayfa (lar) aralığını kabul etmek için PageSelection nesnesini kullanır.
Aşağıdaki örnekte, PDF belgesinin ikinci sayfasından metin çıkarılmıştır. PageSelection.singlePage, çıkarılması gereken sayfanın indeksini alır (indeks 0'dan başlar).
// Load the PDF document from file
PdfDocument pdf = PdfDocument.fromFile(Paths.get("assets/sample.pdf"));
// Extract text from the second page (page index based, starts at 0, so 1 means second page)
String text = pdf.extractTextFromPage(PageSelection.singlePage(1));
// Print the extracted text from the specified page
System.out.println(text);
// Load the PDF document from file
PdfDocument pdf = PdfDocument.fromFile(Paths.get("assets/sample.pdf"));
// Extract text from the second page (page index based, starts at 0, so 1 means second page)
String text = pdf.extractTextFromPage(PageSelection.singlePage(1));
// Print the extracted text from the specified page
System.out.println(text);
PDF Metni Çıktısını Okuma
Çeşitli sayfalardan metin çıkarmak için kullanılabilecek PageSelection sınıfında mevcut olan diğer metodlar şunlardır: firstPage, lastPage, [pageRange](/java/object-reference/api/com/ironsoftware/ironpdf/edit/PageSelection.html#pageRange(int,int) ve allPages.
Yeni Oluşturulan PDF Dosyasından Metin Okuma
Yeni oluşturulmuş bir PDF dosyasından arama metin de gerçekleştirilebilir, ya bir HTML dosyasından ya da bir URL'den. Aşağıdaki örnek kod, bir URL'den PDF oluşturur ve web sitesindeki tüm metni çıkarır.
// Generate PDF from a URL
PdfDocument pdf = PdfDocument.renderUrlAsPdf("https://unsplash.com/");
// Extract all text from the generated PDF
String text = pdf.extractAllText();
// Print the extracted text from the URL
System.out.println("Text extracted from the website: " + text);
// Generate PDF from a URL
PdfDocument pdf = PdfDocument.renderUrlAsPdf("https://unsplash.com/");
// Extract all text from the generated PDF
String text = pdf.extractAllText();
// Print the extracted text from the URL
System.out.println("Text extracted from the website: " + text);
Yeni Dosyadan Okuma
IronPDF, ayrıca PDF dosyalarından görüntü çıkarmak için de kullanılabilir.
Tam kod aşağıdaki gibidir:
import com.ironsoftware.ironpdf.License;
import com.ironsoftware.ironpdf.PdfDocument;
import com.ironsoftware.ironpdf.edit.PageSelection;
import java.io.IOException;
import java.nio.file.Paths;
public class Main {
public static void main(String[] args) throws IOException {
// Set the IronPDF license key for commercial use
License.setLicenseKey("YOUR LICENSE KEY HERE");
// Read text from a specific page in an existing PDF
PdfDocument pdf = PdfDocument.fromFile(Paths.get("assets/sample.pdf"));
String text = pdf.extractTextFromPage(PageSelection.singlePage(1));
System.out.println(text);
// Read all text from a PDF generated from a URL
pdf = PdfDocument.renderUrlAsPdf("https://unsplash.com/");
text = pdf.extractAllText();
System.out.println("Text extracted from the website: " + text);
}
}
import com.ironsoftware.ironpdf.License;
import com.ironsoftware.ironpdf.PdfDocument;
import com.ironsoftware.ironpdf.edit.PageSelection;
import java.io.IOException;
import java.nio.file.Paths;
public class Main {
public static void main(String[] args) throws IOException {
// Set the IronPDF license key for commercial use
License.setLicenseKey("YOUR LICENSE KEY HERE");
// Read text from a specific page in an existing PDF
PdfDocument pdf = PdfDocument.fromFile(Paths.get("assets/sample.pdf"));
String text = pdf.extractTextFromPage(PageSelection.singlePage(1));
System.out.println(text);
// Read all text from a PDF generated from a URL
pdf = PdfDocument.renderUrlAsPdf("https://unsplash.com/");
text = pdf.extractAllText();
System.out.println("Text extracted from the website: " + text);
}
}
Özet
Bu makale, Java'da IronPDF kullanarak PDF dosyalarını nasıl açıp okuyacağınızı açıkladı.
IronPDF, HTML veya URL'den PDF oluşturmayı ve farklı dosya formatlarından dönüştürmeyi kolayca yapabilir. Ayrıca PDF görevlerini hızlı ve kolayca yapmanıza yardımcı olur.
IronPDF'yi 30 gün boyunca ücretsiz deneme ile deneyin ve üretimde sizin için ne kadar iyi çalıştığını görün. IronPDF için ticari lisanslama seçeneklerini keşfedin ve sadece $999 ile başlayın.
Sıkça Sorulan Sorular
Java'da bir PDF okuyucu nasıl oluşturabilirim?
IronPDF kullanarak Java'da bir PDF okuyucu oluşturabilirsiniz. `fromFile` yöntemini kullanarak PDF belgelerini yükleyebilir ve ardından içeriği ayrıştırmak ve manipüle etmek için `extractAllText` gibi yöntemleri kullanabilirsiniz.
IronPDF for Java'yı kullanmak için gereken ön gereklilikleri yükleme adımları nelerdir?
IronPDF'i Java'da kullanmak için Java Development Kit (JDK) kurmanız, Eclipse veya IntelliJ gibi Entegre Geliştirme Ortamı (IDE) kurulumunu yapmanız, bağımlılık yönetimi için Maven'ı yapılandırmanız ve projeye IronPDF kütüphanesini dahil etmeniz gerekmektedir.
Java'da bir PDF dosyasından metni nasıl çıkarırım?
Java'da IronPDF kullanarak bir PDF dosyasından metin çıkarmak için, tüm belgenin metnini almak amacıyla `extractAllText` metodunu ya da belirli bir sayfadan metin çıkarmak için `extractTextFromPage` metodunu kullanabilirsiniz.
Java'da bir URL'den PDF oluşturabilir miyim?
Evet, IronPDF ile `renderUrlAsPdf` yöntemini kullanarak bir URL'den PDF oluşturabilirsiniz; bu yöntem, web içeriğini PDF formatına dönüştürür.
IronPDF, Java'da PDF'lere parola koruması eklemeyi destekliyor mu?
Evet, IronPDF, dijital imzalama ve belgeleri birleştirme veya bölme gibi diğer özelliklerle birlikte PDF'lere şifre koruması eklemeyi destekler.
IronPDF, Java'da hangi dosya formatlarını PDF'ye dönüştürebilir?
IronPDF, HTML ve diğer belge formatları dahil olmak üzere çeşitli dosya formatlarını PDF'ye dönüştürebilir ve PDF oluşturma ve düzenleme için esnek seçenekler sunar.
IronPDF for Java için bir deneme sürümü mevcut mu?
Evet, IronPDF, bir lisans satın almadan önce özelliklerini test etmenizi ve Java uygulamalarınızdaki performansını değerlendirmenizi sağlayan 30 günlük ücretsiz bir deneme sunar.
Bir Java kütüphanesi kullanarak PDF belgesindeki belirli bir sayfadan metni nasıl çıkarabilirim?
IronPDF kullanarak, `extractTextFromPage` yöntemini kullanarak bir PDF'deki belirli bir sayfadan metin çıkarabilirsiniz; bu yöntem, sayfa numarasının veya aralığının belirtilmesini gerektirir.





