IRONSOFTWAREHOME
使用IRONPDF

如何在.NET MAUI中查看PDF(逐步)教程

Curtis Chau
Curtis Chau
Updated: 2026年6月3日

本教程介绍如何通过 IronPDF 的一流支持以编程方式从 PDF 文件中提取文本和图像。

IronPDF

特点

高效的 PDF 转换。 几乎任何机器可以做的事情,IronPDF 都可以做到。 多亏了这个 PDF 库,开发人员可以快速创建、读取文本内容、写入、加载和操作 PDF。

IronPDF 在 Chrome 引擎的帮助下,将 HTML 转换为 PDF 记录。它支持 Windows Forms、HTML、ASPX、Razor HTML、.NET Core、ASP.NET、Windows Forms 和 WPF。 IronPDF 还支持 Xamarin、Blazor、Unity 和 HoloLens 应用程序。 IronPDF 支持 Microsoft .NET 和 .NET Core 应用程序(包括 ASP.NET Web 套件和传统 Windows 套件)。 IronPDF 可用于制作美观的 PDF。

IronPDF 可以使用 HTML5、JavaScript、CSS 和图像创建 PDF。 IronPDF 还拥有强大的 HTML 转 PDF 转换器,它与 PDF 集成。 IronPDF 利用 Chromium 渲染引擎提供了强大的 PDF 转换机制。它不依赖于任何外部来源。

  • PDF 图像可以从多种来源创建,包括 HTML、HTML5、ASPX 和 Razor/MVC 视图。 HTML 和图像资源都可以转换为 PDF。
  • 可用于处理交互式PDF的工具包括填写和提交交互式表单
  • 合并和拆分PDF提取文字和图像从PDF文件,搜索PDF文件中的文本,光栅化PDF为图像,改变字体大小和转换PDF文件。
  • 它允许使用用户代理、代理、cookie、HTTP 头和表单变量验证 HTML 登录表单。
  • 通过提供用户名和密码,IronPDF 可以访问受保护的文档。
  • IronPDF 是一个读取 PDF 文本并填补空白的程序。
  • 允许添加文本、图像、书签水印等。
  • 您可以从 CSS 文件创建 PDF。

欲了解更多详情,请访问此IronPDF 许可信息页面以获取免费限定密钥和专业版本。

如何在VB.NET中解析PDF文件,图1:IronPDF- 字体格式 IronPDF 字体格式化

从 PDF 文件中提取文本

IronPDF 还可以借助 IronPDF 库读取和提取 PDF 文件中的文本。 下面是可用于检查当前 PDF 文件的 IronPDF 代码模式。

从所有页面中提取文本

下面的代码示例演示了第一种方法,以仅用几行代码获取所有 PDF 内容为字符串。

Imports IronPdf

Module Program
    Sub Main(args As String())
        ' Create a PDF Document object from an existing PDF file
        Dim pdfdoc = PdfDocument.FromFile("result.pdf")
        
        ' Extract all the text from the PDF
        Dim AllText As String = pdfdoc.ExtractAllText()
        
        ' Output the extracted text to the console
        Console.WriteLine(AllText)
    End Sub
End Module
VB .NET

上面的示例代码演示如何使用FromFile方法从现有文件中读取PDF并将其转换为PDF文档对象。 该对象提供了一个名为ExtractAllText的方法,能够从PDF中提取纯文本并将其转换为字符串。

按页码提取文本

下面的示例代码说明了如何使用页码从 PDF 文件中提取数据。

Imports IronPdf

Module Program
    Sub Main(args As String())
        ' Create a PDF Document object from an existing PDF file
        Dim pdfdoc = PdfDocument.FromFile("result.pdf")
        
        ' Extract text from the first page (page numbers are zero-based)
        Dim AllText As String = pdfdoc.ExtractTextFromPage(0)
        
        ' Output the extracted text to the console
        Console.WriteLine(AllText)
    End Sub
End Module
VB .NET

上面的代码展示如何使用FromFile函数从现有文件中读取PDF并将其转换为PDF文档对象。 使用此对象可访问 PDF 中的文本和图像。 该对象提供了一个名为ExtractTextFromPage的方法,可以通过发送页面编号作为参数来获取包含该PDF页面上每个单词的字符串。

在页面之间提取文本

下面的代码显示了如何提取多个页面之间的数据。

Imports IronPdf

Module Program
    Sub Main(args As String())
        ' Define a list of page numbers from which to extract text
        Dim Pages As List(Of Integer) = New List(Of Integer) From {3, 5, 7}
        
        ' Create a PDF Document object from an existing PDF file
        Dim pdfdoc = PdfDocument.FromFile("result.pdf")
        
        ' Extract text from the specified pages
        Dim AllText As String = pdfdoc.ExtractTextFromPages(Pages)
        
        ' Output the extracted text to the console
        Console.WriteLine(AllText)
    End Sub
End Module
VB .NET

上面的代码演示如何使用FromFile方法从现有文件中读取PDF并将其转换为PDF文档对象。 此对象允许检查 PDF 中的文本和图像。 该对象具有一个名为ExtractTextFromPages的方法,可以通过传递页面编号列表作为参数来获得包含文档给定页面上所有文本内容的字符串。 左侧是源 PDF,右侧是提取的数据。

如何在VB.NET中解析PDF文件,图2:提取页面间文本输出 在页面之间提取文本输出

从 PDF 文件中提取图像

IronPDF 提供了一系列方法以提取图像,例如:

每种方法都允许从文档的一个或多个页面中提取图像。

Imports IronPdf
Imports System.Drawing

Module Program
    Sub Main(args As String())
        ' Create a PDF Document object from an existing PDF file
        Dim pdfdoc = PdfDocument.FromFile("result.pdf")
        
        ' Extract raw images from the first page
        Dim images = pdfdoc.ExtractRawImagesFromPage(1)
        
        ' Iterate over extracted images
        For Each imgData As Byte() In images
            ' Create a memory stream from byte data
            Using ms As New IO.MemoryStream(imgData)
                ' Create a Bitmap object from the memory stream
                Dim image = New Bitmap(ms)
                
                ' Save the image to the specified output directory
                image.Save("output/test.jpg")
            End Using
        Next
    End Sub
End Module
VB .NET

上面的代码展示如何使用FromFile函数从现有文件中读取文档并将其转换为PDF文档对象。 通过将页面编号传递给对象的ExtractRawImagesFromPage方法,可以获得包含文档该页上每幅图片的字节列表。 使用Bitmap,以帮助保存图片。 下面的图像显示了上述代码的输出。

如何在VB.NET中解析PDF文件,图3:从PDF中提取图像输出 从 PDF 提取图像输出

欲了解更多有关 IronPDF API 代码教程的信息,请参阅 IronPDF 文档。 您还可以访问其他教程,学习如何使用 C# 解析 PDF 文本

结论

库 IronPDF 的开发许可证是免费的。 若在生产环境中使用 IronPDF,可根据开发者的需求购买不同的许可证。 Lite计划从$999开始,无持续费用。 还提供 SaaS 和 OEM 重新分发选项。 所有许可证包括更新、一年的产品支持和永久许可证。 它们同样适用于制造、临时与开发环境。 这是一项一次性购买。 还有其他免费、时间有限的许可证可用。 请访问 全面的 IronPDF 许可信息,阅读 IronPDF 的完整定价和许可详情。 IronPDF 还提供免费的用于复制保护的许可证。

Curtis Chau
技术作家

Curtis Chau 拥有卡尔顿大学的计算机科学学士学位,专注于前端开发,精通 Node.js、TypeScript、JavaScript 和 React。他热衷于打造直观且美观的用户界面,喜欢使用现代框架并创建结构良好、视觉吸引力强的手册。

...
阅读更多

相关文章

Key in blue circle

立即获取免费的 30 天试用版密钥

Your trial license will be sent to your email address

无任何限制。100% 解锁。无需信用卡。

OR
bullet_checked无需信用卡或创建账户无任何限制。100% 解锁。无需信用卡。
  • Logo Aetna
  • Logo NASA
  • Logo GE
  • Logo Porsche
  • Logo USDA
  • Logo Qatar
Join Millions of Engineers who’ve tried Iron Suite
预约您的免费现场演示
Booking Badge

深受全球数百万工程师信赖

Iron Software 的客户徽标
获取您的无义务咨询
填写下面的表格或通过sales@ironsoftware.com
您的资料将始终保密。
深受全球数百万工程师信赖
Iron Software 的客户徽标
立即获取您的免费30 天试用密钥
无需信用卡或创建账户
C# 用于 PDF 的 NuGet 库
通过 NuGet 安装

版本: 2026.9

PM > Install-Package IronPdf
nuget.org/packages/IronPdf/
  1. 在解决方案资源管理器中,右键点击引用,管理 NuGet 包
  2. 选择浏览并搜索 “IronPDF”
  3. 选择包并安装
C# PDF DLL
下载 DLL

版本: 2026.9

或在此处下载 Windows 安装程序。

  1. 下载并解压 IronPDF 到您的解决方案目录中的 ~/Libs 之类的位置
  2. 在 Visual Studio 解决方案资源管理器中,右键点击引用。选择浏览,“IronPDF.dll”

$999