IRONSOFTWAREHOME
USING IRONPDF FOR JAVA

如何在 Java 中讀取 PDF 文件

Curtis Chau
Curtis Chau
Updated: 2026年4月21日

本文將探討如何建立PDF閱讀器,以程式化方式在您的軟體應用中開啟PDF檔案。 要有效地執行此任務,IronPDF for Java是一個幫助在Java程式中使用檔名來開啟和閱讀PDF檔案的系統程式庫。

IronPDF

IronPDF - Java程式庫是建立在已成功的.NET Framework之上。 這使得IronPDF成為相較於其他類別程式庫如Apache PDFBox,處理PDF文件的一個多功能工具。 它提供提取和解析內容,載入文字和載入圖片的功能。 它還提供自訂PDF頁面選項,如頁面佈局、邊距、頁眉和頁尾、頁面方向等。

除了這些,IronPDF還支持從其他文件格式轉換、使用密碼保護PDF、數位簽署、合併和拆分PDF文件。

如何在Java中閱讀PDF檔案

先決條件

要使用IronPDF製作Java PDF閱讀器,必須確保在電腦上安裝以下元件:

  1. JDK - Java開發工具包是建構和運行Java程式所需的。 如果未安裝,請從Oracle網站下載。
  2. IDE - 整合開發環境是一種幫助撰寫、編輯和偵錯程式的軟體。 下載任何Java的IDE,例如Eclipse、NetBeans、IntelliJ。
  3. Maven - Maven是一種自動化工具,幫助從中央儲存庫下載程式庫。 請從Apache Maven網站下載。
  4. IronPDF - 最後,IronPDF需要閱讀Java中的PDF文件。 這需要作為依賴項新增到您的Java Maven專案中。 在pom.xml檔案中包含IronPDF元件與slf4j依賴,如下例所示:
<!-- Add Maven dependencies for IronPDF -->
<dependencies>
    <!-- IronPDF Dependency -->
    <dependency>
        <groupId>com.ironsoftware</groupId>
        <artifactId>ironpdf</artifactId>
        <version>your-version-here</version>
    </dependency>

    <!-- SLF4J Dependency necessary for logging -->
    <dependency>
        <groupId>org.slf4j</groupId>
        <artifactId>slf4j-api</artifactId>
        <version>1.7.32</version>
    </dependency>
</dependencies>
XML

新增必要的導入

首先,在Java原始檔案的頂部新增以下程式碼,以參考所有需要的IronPDF方法:

import com.ironsoftware.ironpdf.*;
// Necessary imports from IronPDF library
Java

然後,使用有效的許可金鑰配置IronPDF以使用其方法。 在主方法中調用setLicenseKey方法。

License.setLicenseKey("Your license key");
// Set your IronPDF license key - required for full version
Java

**注意:**您可以獲得一個免費試用授權金鑰來建立、閱讀和列印PDF。

在Java中閱讀現有的PDF文件

要閱讀PDF文件,必須有PDF文件,或者可以建立一個。 本文將使用已建立的PDF文件。程式碼簡單且為提取文件中的文字的兩步驟過程:

// Load the PDF document from file
PdfDocument pdf = PdfDocument.fromFile(Paths.get("assets/sample.pdf"));
// Extract all text from the PDF
String text = pdf.extractAllText();
// Print the extracted text
System.out.println(text);
Java

在上面的程式碼中,fromFile開啟了一個PDF文件。 方法Paths.get獲取文件的目錄,並準備從文件中提取內容。然後,[extractAllText](/java/object-reference/api/com/ironsoftware/ironpdf/PdfDocument.html#extractAllText()讀取文件中的所有文字。

輸出如下:

如何在Java中閱讀PDF文件,圖1:閱讀PDF文字輸出 閱讀PDF文字輸出

從特定頁面閱讀文字

IronPDF也可以從PDF中的特定頁面讀取內容。 方法PageSelection物件接受需要讀取文字的頁面範圍。

在以下範例中,文字被從PDF文件的第二頁中提取出來。 PageSelection.singlePage會提取需要的頁面索引(索引從0開始)。

// Load the PDF document from file
PdfDocument pdf = PdfDocument.fromFile(Paths.get("assets/sample.pdf"));
// Extract text from the second page (page index based, starts at 0, so 1 means second page)
String text = pdf.extractTextFromPage(PageSelection.singlePage(1));
// Print the extracted text from the specified page
System.out.println(text);
Java

如何在Java中閱讀PDF文件,圖2:閱讀PDF文字輸出 閱讀PDF文字輸出

在PageSelection類中可用的其他方法包括從多個頁面提取文字:firstPage、[lastPage](/java/object-reference/api/com/ironsoftware/ironpdf/edit/PageSelection.html#firstPage()、[pageRange](/java/object-reference/api/com/ironsoftware/ironpdf/edit/PageSelection.html#pageRange(int,int)及[allPages](/java/object-reference/api/com/ironsoftware/ironpdf/edit/PageSelection.html#allPages()。

從新生成的PDF文件閱讀文字

從HTML文件或URL新生成的PDF文件中也可以執行文字搜尋。 以下範例程式碼從URL生成PDF並提取網站上的所有文字。

// Generate PDF from a URL
PdfDocument pdf = PdfDocument.renderUrlAsPdf("https://unsplash.com/");
// Extract all text from the generated PDF
String text = pdf.extractAllText();
// Print the extracted text from the URL
System.out.println("Text extracted from the website: " + text);
Java

如何在Java中閱讀PDF文件,圖3:從新文件中閱讀 從新文件中閱讀

IronPDF也可以用來從PDF文件中提取圖片。

完整的程式碼如下:

import com.ironsoftware.ironpdf.License;
import com.ironsoftware.ironpdf.PdfDocument;
import com.ironsoftware.ironpdf.edit.PageSelection;

import java.io.IOException;
import java.nio.file.Paths;

public class Main {
    public static void main(String[] args) throws IOException {
        // Set the IronPDF license key for commercial use
        License.setLicenseKey("YOUR LICENSE KEY HERE");

        // Read text from a specific page in an existing PDF
        PdfDocument pdf = PdfDocument.fromFile(Paths.get("assets/sample.pdf"));
        String text = pdf.extractTextFromPage(PageSelection.singlePage(1));
        System.out.println(text);

        // Read all text from a PDF generated from a URL
        pdf = PdfDocument.renderUrlAsPdf("https://unsplash.com/");
        text = pdf.extractAllText();
        System.out.println("Text extracted from the website: " + text);
    }
}
Java

摘要

本文解釋了如何使用IronPDF在Java中開啟和閱讀PDF文件。

IronPDF幫助輕鬆從HTML或URL建立PDF,並從其他文件格式轉換。 它還幫助快速輕鬆地完成PDF相關任務。

試用IronPDF30天的免費試用,看看在生產環境中它能如何出色工作。 探索商業授權選擇,IronPDF的價格僅從$999開始。

Curtis Chau
技術作家

Curtis Chau擁有Carleton大學的電腦科學學士學位,專精於前端開發,擁有Node.js、TypeScript、JavaScript和React的專業知識。Curtis熱衷於建立直觀且美觀的使用者介面,喜愛使用現代框架並建立結構良好、視覺吸引力的手冊。

...
閱讀更多

相關文章

Key in blue circle

立即免費取得 30 天試用金鑰。

Your trial license will be sent to your email address

無任何限制。100% 解鎖。無需信用卡。

OR
bullet_checked無需信用卡或建立帳號無任何限制。100% 解鎖。無需信用卡。
  • Logo Aetna
  • Logo NASA
  • Logo GE
  • Logo Porsche
  • Logo USDA
  • Logo Qatar
Join Millions of Engineers who’ve tried Iron Suite
預訂您的免費 即時演示
Booking Badge

全球數百萬工程師的信任

Iron Software的客戶商標
獲取您的無義務諮詢
填寫以下表格或發送電子郵件至sales@ironsoftware.com
您的詳細資訊始終保持機密。
全球數百萬工程師的信任
Iron Software的客戶商標
立即獲取您的30天試用金鑰。
無需信用卡或帳戶建立
C# 用於PDF的NuGet程式庫
使用NuGet安裝

版本: 2026.9

PM > Install-Package IronPdf
nuget.org/packages/IronPdf/
  1. 在解決方案資源管理器,右鍵點選參考,管理NuGet包
  2. 選擇瀏覽並搜尋"IronPdf"
  3. 選擇套件並安裝
C# PDF DLL
下載DLL

版本: 2026.9

或者點擊此處下載Windows安裝程式。

  1. 下載並解壓IronPDF到類似~/Libs的位置,位於您的解決方案目錄中
  2. 在Visual Studio解決方案資源管理器,右鍵點選參考。選擇瀏覽,"IronPdf.dll"

授權從$999起