IRONSOFTWAREHOME
在 C# 中读取 PDF 文件
import {PdfDocument} from "@ironsoftware/ironpdf";

(async () => {
    // Extracting Image and Text content from Pdf Documents
    // Import existing PDF document
    const pdf = await PdfDocument.fromHtml("old_report.pdf");
    
    // Get all text to put in a search index
    const text = await pdf.extractText();
    
    // Get all Images
    const imagesBuffer = await pdf.extractRawImages();
    
    const pageCount = await pdf.getPageCount()
    // Or even find the precise text and images for each page in the document
    for (let index = 0; index < pageCount; index++) {
        text = await pdf.extractText([index]);
        imagesBuffer = await pdf.extractRawImages([index]);
    }
})();
npm i @ironsoftware/ironpdf
在 C# 中读取 PDF 文件

在 C# 中读取 PDF 文件

提取文本和图像可以在从一种文档格式转换到另一种时方便数据迁移。 提取的内容可以保存在更易访问和可编辑的格式中,降低数据丢失的风险。

嵌入的图像和文本可以独立于PDF文档提取。 提取的文本将是普通字符串,而提取的图像将是图像缓冲区格式,之后可以导出或进一步处理。

使用extractRawImages方法提取图像。

这是一个经过更正和注释的示例,说明您可能如何执行此操作:

在上述C#代码中:

  • 我们使用IronPDF库加载PDF文档。
  • 调用ExtractText()方法从PDF中检索文本。 该文本输出到控制台。
  • ExtractImages()方法用于提取图像,这些图像存储在字节数组中。 然后每个图像都以指定文件名保存到文件系统中。

有关如何使用这些方法的更详细说明,请访问IronPDF文档。

探索有关使用 IronPDF 阅读 PDF 文本的更多内容
在 GitHub 上查看

准备开始了吗?

版本:2026.6刚刚发布

Key in blue circle

立即获取免费的 30 天试用版密钥。

Your trial license will be sent to your email address

无任何限制。100% 解锁。无需信用卡。

OR
bullet_checked无需信用卡或创建账户无任何限制。100% 解锁。无需信用卡。
  • Logo Aetna
  • Logo NASA
  • Logo GE
  • Logo Porsche
  • Logo USDA
  • Logo Qatar
Join Millions of Engineers who’ve tried Iron Suite
预约您的免费现场演示
Booking Badge

深受全球数百万工程师信赖

Iron Software 的客户徽标
获取您的无义务咨询
填写下面的表格或通过sales@ironsoftware.com
您的资料将始终保密。
深受全球数百万工程师信赖
Iron Software 的客户徽标
立即获取您的免费30 天试用密钥。
无需信用卡或创建账户
Node.js 模块下载用于 PDF
using npm 安装

版本: 2026.6

  1. 下载并安装 Node.js 12+。
  2. 在终端中执行上述命令。

$999 起