IRONSOFTWAREHOME
在 C# 中讀取 PDF 檔案
import {PdfDocument} from "@ironsoftware/ironpdf";

(async () => {
    // Extracting Image and Text content from Pdf Documents
    // Import existing PDF document
    const pdf = await PdfDocument.fromHtml("old_report.pdf");
    
    // Get all text to put in a search index
    const text = await pdf.extractText();
    
    // Get all Images
    const imagesBuffer = await pdf.extractRawImages();
    
    const pageCount = await pdf.getPageCount()
    // Or even find the precise text and images for each page in the document
    for (let index = 0; index < pageCount; index++) {
        text = await pdf.extractText([index]);
        imagesBuffer = await pdf.extractRawImages([index]);
    }
})();
npm i @ironsoftware/ironpdf
在 C# 中讀取 PDF 檔案

在 C# 中讀取 PDF 檔案

提取文字和圖片可以在從一種文件格式轉換到另一種時促進資料遷移。 提取的內容可以保存在更易於存取和編輯的格式中,從而減少資料丟失的風險。

嵌入的圖片和文字可以獨立於PDF文件進行提取。 提取的文字將是普通字串,而提取的圖片將是圖片緩衝區格式,然後可以導出或進一步處理。

使用extractRawImages方法從PDF文件中提取圖片。

這裡是一個修正過並附有註解的範例,說明您如何進行此操作:

在上述C#程式碼中:

  • 我們使用IronPDF程式庫載入PDF文件。
  • 調用了ExtractText()方法從PDF中檢索文字。 這段文字被輸出到控制台。
  • 使用ExtractImages()方法提取圖片,這些圖片以位元組陣列形式儲存。 然後將每個圖片以指定的檔名保存到文件系統。

有關如何使用這些方法的詳細指導,請存取IronPDF文件。

深入了解使用IronPDF閱讀PDF文字
在 GitHub 上查看

準備好開始了嗎?

版本:2026.6剛剛發布

Key in blue circle

立即免費取得 30 天試用金鑰。

Your trial license will be sent to your email address

無任何限制。100% 解鎖。無需信用卡。

OR
bullet_checked無需信用卡或建立帳號無任何限制。100% 解鎖。無需信用卡。
  • Logo Aetna
  • Logo NASA
  • Logo GE
  • Logo Porsche
  • Logo USDA
  • Logo Qatar
Join Millions of Engineers who’ve tried Iron Suite
預訂您的免費線上演示
Booking Badge

獲得來自全球數百萬工程師的信賴

Iron Software的客戶徽標
獲取您的無義務諮詢
填寫以下表格或發送電子郵件至sales@ironsoftware.com
您的資料將始終保密。
獲得來自全球數百萬工程師的信賴
Iron Software的客戶徽標
立即獲取您的30天試用金鑰。
無需信用卡或帳戶建立
Node.js模組下載PDF
使用npm安裝

版本: 2026.6

  1. 下載並安裝Node.js 12+。
  2. 在終端機中執行上述命令。

授權從$999起