Altbilgi içeriğine atla
JAVA IçIN IRONPDF KULLANıMı

Java'da PDF'den Veri Nasıl Çıkarılır

Bu eğitim, bir PDF dosyasından veri çıkartmak için IronPDF Java için kullanımını gösterecek. Ortamın kurulması, kütüphanenin içe aktarılması, giriş dosyasının okunması ve gereken verilerin çıkartılması tümüyle kod örnekleri ile açıklanmıştır.

2. IronPDF Java PDF Kütüphanesi

IronPDF, geliştiricilere Java uygulamaları içinde PDF dosyalarını oluşturma, düzenleme ve IronPDF Java için kullanarak verileri çıkartma yeteneği sağlayan bir yazılım kütüphanesidir. HTML belgelerinden PDF oluşturmanıza, görüntülerden ve daha fazlasından, birden fazla PDF'yi birleştirmenize, PDF dosyalarını bölmenize ve mevcut PDF'leri manipüle etmenize olanak tanır. IronPDF ayrıca şifre koruma özellikleri ile PDF'leri güvence altına alma ve PDF'lere dijital imzalar ekleme gibi özellikler de sunar.

Iron Software tarafından geliştirilmiş ve sürdürülmektedir. En iyi puanlanan özelliklerinden biri, PDF dosyalarından, HTML ve URL'lerden metin ve veri çıkartmaktır.

3. Ön Koşullar

IronPDF kullanarak PDF dosyalarından veri çıkarmak için aşağıdaki gereksinimleri karşılamanız gerekir:

  1. Java kurulumu: Sisteminizde Java'nın kurulu olduğundan ve yolunun ortam değişkenlerine ayarlandığından emin olun. Java'yı henüz yüklemediyseniz, talimatlar için Java web sitesinin bu indirme sayfasına bakın.
  2. Java IDE: Eclipse veya IntelliJ gibi bir Java IDE'ye sahip olun. Eclipse'i bu Eclipse indirme sayfasından ve IntelliJ'yi bu IntelliJ indirme sayfasından indirebilirsiniz.
  3. IronPDF kütüphanesi: IronPDF kütüphanesini proje gereksinimi olarak indirip ekleyin. Kurulum talimatları için IronPDF kurulum talimatları sayfasını ziyaret edin.
  4. Maven kurulumu: PDF dönüşüm işlemine başlamadan önce Maven'ın çalışır durumda ve IDE'nizle entegre olduğundan emin olun. Maven kurulumu JetBrains eğitimine Maven'ı yüklemek ve entegre etmek için başvurun.

4. IronPDF for Java Kurulumu

IronPDF for Java kurulumu, tüm gereksinimler karşılandığında kolay ve karmaşık değildir. Bu kılavuz, JetBrains IntelliJ IDEA kullanılarak kurulumu ve örnek kodların çalıştırılmasını gösterecektir.

İşte yapmanız gerekenler:

  • IntelliJ IDEA'yı Açın: Sisteminizde JetBrains IntelliJ IDEA'yı başlatın.
  • Bir Maven Projesi Oluşturun: IntelliJ IDEA'da yeni bir Maven projesi oluşturun. Bu, IronPDF for Java'nın kurulumu için uygun bir ortam sağlayacaktır.

Java'da PDF'ten Veri Çıkarma, Şekil 1: IntelliJ'de Yeni Maven Projesi IntelliJ'de Yeni Maven Projesi

  • Yeni bir pencere açılacaktır. Projenin adını girin ve Bitir'e tıklayın.

Java'da PDF'ten Veri Çıkarma, Şekil 2: Maven Projesini Adlandırın ve Bitir'e tıklayın Maven Projesini Adlandırın ve Bitir'e tıklayın

  • Bitir'e tıkladığınızda bir pom.xml dosyası ile yeni bir proje açılacaktır. Bu, IronPDF Java Maven gereksinimlerini eklemek için kullanılacaktır.

Java'da PDF'ten Veri Çıkarma, Şekil 3: pom.xml dosyası pom.xml dosyası

Aşağıdaki bağımlılıkları pom.xml dosyasına ekleyin veya Sonatype Central'daki IronPDF kütüphanesi sayfasından JAR dosyasını indirebilirsiniz.

<dependency>
    <groupId>com.ironsoftware</groupId>
    <artifactId>ironpdf</artifactId>
    <version>1.0.0</version> 
</dependency>
<dependency>
    <groupId>com.ironsoftware</groupId>
    <artifactId>ironpdf</artifactId>
    <version>1.0.0</version> 
</dependency>
XML

Bağımlılıkları pom.xml dosyasına yerleştirdikten sonra, dosyanın sağ üst köşesinde küçük bir simge belirecektir.

Java'da PDF'ten Veri Çıkarma, Şekil 4: Maven bağımlılıklarını otomatik olarak yüklemek için kayan simgeye tıklayın Maven gereksinimlerini otomatik kurmak için yüzen simgeye tıklayın

Bu butona tıklayarak IronPDF for Java'nın Maven gereksinimlerini yükleyin. İnternet bağlantınızın hızına bağlı olarak bu, sadece birkaç dakika sürmelidir.

5. Veri Çıkartma

IronPDF, PDF belgelerinden veri oluşturma, düzenleme ve çıkarma işlemleri için bir Java kütüphanesidir. PDF dosyalarından, URL'lerden ve tablolardan metin çıkarmak için basit bir API sağlar.

5.1. PDF Belgelerinden Veri Çıkarma

IronPDF for Java kullanarak, PDF belgelerinden metin verilerini kolayca çıkarabilirsiniz. Aşağıda bir PDF dosyasından veri çıkartmak için örnek bir kod bulunmaktadır.

Java'da PDF'ten Veri Çıkarma, Şekil 5: PDF Girişi PDF Girişi

// Import the necessary IronPDF package for working with PDF documents
import com.ironsoftware.ironpdf.PdfDocument;

import java.io.IOException;
import java.nio.file.Paths;

public class Main {
    public static void main(String[] args) throws IOException {
        // Load the PDF document from the specified file
        PdfDocument pdf = PdfDocument.fromFile(Paths.get("business plan.pdf"));

        // Extract all text from the PDF document
        String text = pdf.extractAllText();

        // Print the extracted text to the console
        System.out.println("Text extracted from the PDF: " + text);
    }
}
// Import the necessary IronPDF package for working with PDF documents
import com.ironsoftware.ironpdf.PdfDocument;

import java.io.IOException;
import java.nio.file.Paths;

public class Main {
    public static void main(String[] args) throws IOException {
        // Load the PDF document from the specified file
        PdfDocument pdf = PdfDocument.fromFile(Paths.get("business plan.pdf"));

        // Extract all text from the PDF document
        String text = pdf.extractAllText();

        // Print the extracted text to the console
        System.out.println("Text extracted from the PDF: " + text);
    }
}
JAVA

Kaynak kodu, aşağıda verilen çıktıyı üretir:

> Text extracted from the PDF:
> 
> CRAFT-ARENA
> 
> Muhammad Waleed Butt
> 
> Hassan Khan
> 
> ABOUT US
> 
> Craft-Arena is a partnership based business that will help local crafters of Pakistan to sell their handicrafts at good prices and helps them earn a good living.

5.2. URL'lerden Veri Çıkarma

IronPDF for Java, çalışma zamanında URL'yi PDF'ye dönüştürür ve bu URL'den metin çıkarır. Bu örnek URL'lerden metin çıkarma için kaynak kodu gösterecektir.

// Import the necessary IronPDF package for working with PDF documents
import com.ironsoftware.ironpdf.PdfDocument;

import java.io.IOException;

public class Main {
    public static void main(String[] args) throws IOException {
        // Convert a URL to a PDF and load it into a PdfDocument
        PdfDocument pdf = PdfDocument.renderUrlAsPdf("https://ironpdf.com/java/");

        // Extract all text from the PDF document
        String text = pdf.extractAllText();

        // Print the extracted text to the console
        System.out.println("Text extracted from the URLs: " + text);
    }
}
// Import the necessary IronPDF package for working with PDF documents
import com.ironsoftware.ironpdf.PdfDocument;

import java.io.IOException;

public class Main {
    public static void main(String[] args) throws IOException {
        // Convert a URL to a PDF and load it into a PdfDocument
        PdfDocument pdf = PdfDocument.renderUrlAsPdf("https://ironpdf.com/java/");

        // Extract all text from the PDF document
        String text = pdf.extractAllText();

        // Print the extracted text to the console
        System.out.println("Text extracted from the URLs: " + text);
    }
}
JAVA

Java'da PDF'ten Veri Çıkarma, Şekil 6: Çıkartılmış Web Sayfası Verisi Çıkarılan Web Sayfası Verisi

5.3. Tablo Verilerinden Veri Çıkarma

IronPDF for Java kullanarak bir PDF'den tablo verilerini çıkarmak çok basittir; Tek ihtiyacınız olan bir tablo içeren bir PDF ve aşağıdaki kodu çalıştırmak.

Java'da PDF'ten Veri Çıkarma, Şekil 7: Örnek PDF Tablo Girişi Örnek PDF Tablo Girişi

// Import the necessary IronPDF package for working with PDF documents
import com.ironsoftware.ironpdf.PdfDocument;

import java.io.IOException;
import java.nio.file.Paths;

public class Main {
    public static void main(String[] args) throws IOException {
        // Load the PDF document from the specified file
        PdfDocument pdf = PdfDocument.fromFile(Paths.get("table.pdf"));

        // Extract all text from the PDF document, including table data
        String text = pdf.extractAllText();

        // Print the extracted table data to the console
        System.out.print("Text extracted from the Marked tables: " + text);
    }
}
// Import the necessary IronPDF package for working with PDF documents
import com.ironsoftware.ironpdf.PdfDocument;

import java.io.IOException;
import java.nio.file.Paths;

public class Main {
    public static void main(String[] args) throws IOException {
        // Load the PDF document from the specified file
        PdfDocument pdf = PdfDocument.fromFile(Paths.get("table.pdf"));

        // Extract all text from the PDF document, including table data
        String text = pdf.extractAllText();

        // Print the extracted table data to the console
        System.out.print("Text extracted from the Marked tables: " + text);
    }
}
JAVA
> Test Case Description Expected Result Actual Result Status
> 
> 1 Test login functionality User should be able to log in with valid credentials
> 
> User log in successfully Pass
> 
> 2 Test search functionality Search results should be relevant and accurate
> 
> Search is accurate and provide relevant products Pass
> 
> 3 Test checkout process User should be able to complete a purchase successfully
> 
> User can purchase successfully Pass

6. Sonuç

Sonuç olarak, bu eğitim, IronPDF for Java kullanarak bir PDF dosyasından veri, özellikle tablo verilerini nasıl çıkarabileceğinizi gösterdi.

Daha fazla bilgi için lütfen IronPDF web sitesindeki PDF'den metin çıkartma örneğine başvurun.

IronPDF, ticari lisans detayları için burayı ziyaret edin, başlangıç fiyatı $999. Ancak, IronPDF deneme lisansı kullanarak prodüksiyonda ücretsiz deneme ile değerlendirebilirsiniz.

Sıkça Sorulan Sorular

Java'da PDF'den metni nasıl çıkartabilirim?

IronPDF for Java kullanarak, bir PDF belgesi PdfDocument sınıfı ile yüklenip, metni almak için extractAllText yöntemi kullanılabilir.

Java'da bir URL'den veri çıkartıp PDF'ye dönüştürebilir miyim?

Evet, IronPDF for Java, URL'yi çalıştırırken PDF'ye dönüştürmenize ve PdfDocument sınıfını kullanarak verileri çıkartmanıza olanak tanır.

IntelliJ IDEA'de IronPDF'i nasıl kurarım?

IntelliJ IDEA'de IronPDF'i kurmak için, yeni bir Maven projesi oluşturun, `pom.xml` dosyanıza IronPDF kütüphanesini ekleyin ve görünen kayan simgeye tıklayarak Maven bağımlılıklarını yükleyin.

Java'da IronPDF'i kullanmanın ön koşulları nelerdir?

Ön koşullar, Java'nın yüklü olması, Eclipse veya IntelliJ gibi bir Java IDE'si, IronPDF kütüphanesi ve Maven'ı IDE'nizle entegre etmiş olmaktır.

Java kullanarak bir PDF'den tablo verilerini nasıl çıkarabilirim?

Java için IronPDF kullanarak bir PDF'den tablo verilerini çıkartmak için, PdfDocument sınıfı ile PDF belgesini yükleyin ve tablo verilerini almak için extractAllText yöntemini kullanın.

Java için IronPDF kullanmak için ticari bir lisans gerekli mi?

Evet, Java için IronPDF ticari bir lisans gerektirir, ancak değerlendirme amaçlı ücretsiz bir deneme mevcuttur.

Java'da IronPDF kullanımı için öğretici nereden bulabilirim?

IronPDF for Java kullanma öğreticileri ve örnekleri özellikle örnekler ve öğreticiler bölümlerinde IronPDF web sitesinde bulunabilir.

Java geliştiricileri için IronPDF hangi işlevleri sağlar?

Java için IronPDF, PDF dosyalarını oluşturma, düzenleme, birleştirme, bölme ve manipüle etme yetenekleri sağlar ve PDF'lere parola koruması ekleme ve dijital imzalar ekleme gibi özellikler sunar.

Java kullanarak PDF'lerden veri çıkarma ile ilgili sorunları nasıl çözebilirim?

Bağımlılıkların son Java sürümü, uyumlu bir IDE ve IronPDF kütüphanesi ile kayıtlı olduğundan emin olun. `pom.xml` dosyanızda doğru Maven entegrasyonunu ve kütüphane bağımlılıklarını kontrol edin.

Darrius Serrant
Tam Yığın Yazılım Mühendisi (WebOps)

Darrius Serrant, Miami Üniversitesi'nden Bilgisayar Bilimi alanında Lisans Derecesine sahip ve Iron Software'de Tam Yığın WebOps Pazarlama Mühendisi olarak çalışıyor. Genç yaşlardan itibaren kodlamaya çekildi, bilgisayar bilimi hem gizemli hem de erişilebilir olarak görüldü ve bu özellik, yaratıcılık ...

Daha Fazla Oku

Iron Destek Ekibi

Haftada 5 gün, 24 saat çevrimiçiyiz.
Sohbet
E-posta
Beni Ara