
ASP PDF Viewer (Developer Tutorial)
程式化的PDF處理在金融、醫療、法律和教育等行業中至關重要,因為關鍵資訊需要從PDF文件中處理、分析和提取,用於資料分析、文件管理和自動化等目的。 儘管其重要性,這項任務可能很有挑戰性。
IronPDF:C# PDF程式庫
IronPDF使您能夠輕鬆處理極其困難的任務。 它允許您輕鬆地編輯PDF文件中的文字,與處理文字文件中的文字方式類似,同時允許您在任何操作系統中匯出文件。 IronPDF應用程式涵蓋了查看、修改和從PDF中提取內容的完整過程。
利用IronPDF邁出正確的一步
使用具有IronPDF軟體的任何電腦,可以快速輕鬆地讀取和寫入PDF文件格式中的文字。 安裝是一個簡單的任務。 這是學習用C#讀取PDF文件的最佳方式。 您也可以免費下載IronPDF進行開發。 如果您探索IronPDF,您會注意到該程式庫提供了豐富的功能,使得使用PDF變得非常容易。 在您的空閒時間探索類別吧!這裡有幾個使用HTML建立PDF的C#範例,可以學習如何從讀取PDF中建立最佳輸出。
使用IronPDF讀取PDF文件
步驟1:安裝IronPDF套件
首先,您需要將IronPDF NuGet套件安裝到您的.NET專案中。 您可以通過在Visual Studio中打開套件管理控制台並輸入以下命令來完成此操作:
步驟2:匯入IronPDF程式庫
接下來,您需要將IronPDF程式庫匯入您的程式碼,方法是在文件頂部新增以下語句:
using IronPdf;Imports IronPdf步驟3:載入PDF文件
一旦您匯入了IronPDF程式庫,就可以使用以下程式碼將PDF文件載入到您的程式碼中:
// Load the PDF document from file path
PdfDocument pdf = PdfDocument.FromFile(@"C:\dotnet.pdf");
// Define the output path for the saved PDF
var outputPath = "Example.pdf";
// Save the PDF document to the specified output path
pdf.SaveAs(outputPath);' Load the PDF document from file path
Dim pdf As PdfDocument = PdfDocument.FromFile("C:\dotnet.pdf")
' Define the output path for the saved PDF
Dim outputPath = "Example.pdf"
' Save the PDF document to the specified output path
pdf.SaveAs(outputPath)步驟4:從PDF中提取文字
IronPDF提供了一系列方法來從現有的PDF文件中提取文字。例如,您可以使用以下程式碼片段開始從PDF中提取文字並將其列印到控制台:
// Extract text from the loaded PDF document
string text = pdf.ExtractText();
// Print the extracted text to the console
Console.WriteLine(text);' Extract text from the loaded PDF document
Dim text As String = pdf.ExtractText()
' Print the extracted text to the console
Console.WriteLine(text)使用上述程式碼,您可以從PDF文件中提取文字。
使用IronPDF從PDF中提取文字
步驟5:將PDF光柵化為圖像
讓我們使用IronPDF將PDF文件光柵化為圖像。 首先,匯入所需的程式庫:
using System.Linq;
using IronPdf;
using IronSoftware.Drawing;Imports System.Linq
Imports IronPdf
Imports IronSoftware.Drawing然後程式碼使用RasterizeToImageFiles方法將PDF文件的所有頁面提取到資料夾中作為圖像文件。 提取的圖像可以保存為PNG或JPG文件,並且可以指定圖像的尺寸和頁面範圍。
// Extract all pages to a folder as image files with PNG format
pdf.RasterizeToImageFiles(@"C:\image\folder\*.png");
// Extract all pages to JPG images with specified dimensions
pdf.RasterizeToImageFiles(@"C:\image\folder\example_pdf_image_*.jpg", 100, 80);' Extract all pages to a folder as image files with PNG format
pdf.RasterizeToImageFiles("C:\image\folder\*.png")
' Extract all pages to JPG images with specified dimensions
pdf.RasterizeToImageFiles("C:\image\folder\example_pdf_image_*.jpg", 100, 80)最後,程式碼使用AnyBitmap物件,這些物件可以在程式碼中進一步處理和操作。
// Extract all pages as AnyBitmap objects for further processing
AnyBitmap[] pdfBitmaps = pdf.ToBitmap();' Extract all pages as AnyBitmap objects for further processing
Dim pdfBitmaps() As AnyBitmap = pdf.ToBitmap()上述程式碼示範了如何使用IronPDF提取PDF文件的內容,並將提取的資料保存為圖像文件或AnyBitmap物件以進一步處理。
步驟7:操作PDF頁面
讓我們學習如何通過使用IronPDF操作PDF文件的頁面。
程式碼首先使用RemovePages方法從PDF文件中移除頁面2和3:
// Remove pages two and three from the PDF document
pdf.RemovePages(1, 2);' Remove pages two and three from the PDF document
pdf.RemovePages(1, 2)RemovePages方法需要兩個參數:要移除的起始頁碼(在本例中是頁面2,因為頁面編號從0開始,表示為1)和要移除的頁數(在本例中為2頁)。
步驟6:保存PDF文件
最後,您可以使用SaveAs方法將PDF文件保存到您的本地系統中。 以下是保存PDF文件的程式碼:
// Save the PDF document to a specified output path
pdf.SaveAs(outputPath);' Save the PDF document to a specified output path
pdf.SaveAs(outputPath)IronPDF相容性
IronPDF高度相容於所有最新的.NET Framework,包括.NET 7。它還支援.NET Blazor和.NET MAUI,這是微軟為Web開發提供的最新產品。 程式庫與這些框架的相容性使開發者能夠將IronPDF無縫整合到他們的應用程式中,並利用其強大的功能。
IronPDF的主要功能之一是能夠在.NET Blazor和.NET MAUI中讀取PDF文件。 此功能使開發者能夠快速、輕鬆地從PDF文件中讀取和提取資料,並在.NET應用程式中使用它們。 此能力在處理大量資料時尤其有用。 開發者不需要其他程式庫即可在他們的.NET專案中使用IronPDF。
在IronPDF的網站上了解更多關於IronPDF在.NET Blazor中的應用和將IronPDF整合至.NET MAUI的資訊。
總結
總之,程式化讀取PDF文件在各種行業中至關重要。 IronPDF提供了一個綜合解決方案來處理此任務,提供了廣泛的功能來讀取、修改和從PDF文件中提取內容。IronPDF易於安裝和使用,只需幾個簡單步驟。
程式庫提供了方法來從PDF文件中提取文字、將PDF光柵化為圖像、操作頁面以及保存PDF文件。 無論您是程式化PDF處理的新手還是有經驗的開發者,IronPDF都是提升您技能的理想工具。
如果您正在尋找用於C#中讀取PDF文件的可靠且高效的解決方案,IronPDF值得一試,特別是其授權選項和價格資訊,以及提供的免費試用。 您可以在下圖中看到IronPDF提供的更多方案。 您可以選擇符合您需求的套件。
IronPDF授權價格

Curtis Chau擁有Carleton大學的電腦科學學士學位,專精於前端開發,擁有Node.js、TypeScript、JavaScript和React的專業知識。Curtis熱衷於建立直觀且美觀的使用者介面,喜愛使用現代框架並建立結構良好、視覺吸引力的手冊。
相關文章


