ASP PDF Viewer (Developer Tutorial)
程式化的PDF處理在金融、醫療、法律和教育等行業中至關重要,因為關鍵資訊需要從PDF文件中處理、分析和提取,用於資料分析、文件管理和自動化等目的。 儘管其重要性,這項任務可能很有挑戰性。
IronPDF:C# PDF程式庫
IronPDF使您能夠輕鬆處理極其困難的任務。 它允許您輕鬆地編輯PDF文件中的文字,與處理文字文件中的文字方式類似,同時允許您在任何操作系統中匯出文件。 IronPDF應用程式涵蓋了查看、修改和從PDF中提取內容的完整過程。
利用IronPDF邁出正確的一步
使用具有IronPDF軟體的任何電腦,可以快速輕鬆地讀取和寫入PDF文件格式中的文字。 安裝是一個簡單的任務。 這是學習用C#讀取PDF文件的最佳方式。 您也可以免費下載IronPDF進行開發。 如果您探索IronPDF,您會注意到該程式庫提供了豐富的功能,使得使用PDF變得非常容易。 在您的空閒時間探索類別吧!這裡有幾個使用HTML建立PDF的C#範例,可以學習如何從讀取PDF中建立最佳輸出。
使用IronPDF讀取PDF文件
步驟1:安裝IronPDF套件
首先,您需要將IronPDF NuGet套件安裝到您的.NET專案中。 您可以通過在Visual Studio中打開套件管理控制台並輸入以下命令來完成此操作:
Install-Package IronPdf
步驟2:匯入IronPDF程式庫
接下來,您需要將IronPDF程式庫匯入您的程式碼,方法是在文件頂部新增以下語句:
using IronPdf;
using IronPdf;
Imports IronPdf
步驟3:載入PDF文件
一旦您匯入了IronPDF程式庫,就可以使用以下程式碼將PDF文件載入到您的程式碼中:
// Load the PDF document from file path
PdfDocument pdf = PdfDocument.FromFile(@"C:\dotnet.pdf");
// Define the output path for the saved PDF
var outputPath = "Example.pdf";
// Save the PDF document to the specified output path
pdf.SaveAs(outputPath);
// Load the PDF document from file path
PdfDocument pdf = PdfDocument.FromFile(@"C:\dotnet.pdf");
// Define the output path for the saved PDF
var outputPath = "Example.pdf";
// Save the PDF document to the specified output path
pdf.SaveAs(outputPath);
' Load the PDF document from file path
Dim pdf As PdfDocument = PdfDocument.FromFile("C:\dotnet.pdf")
' Define the output path for the saved PDF
Dim outputPath = "Example.pdf"
' Save the PDF document to the specified output path
pdf.SaveAs(outputPath)
步驟4:從PDF中提取文字
IronPDF提供了一系列方法來從現有的PDF文件中提取文字。例如,您可以使用以下程式碼片段開始從PDF中提取文字並將其列印到控制台:
// Extract text from the loaded PDF document
string text = pdf.ExtractText();
// Print the extracted text to the console
Console.WriteLine(text);
// Extract text from the loaded PDF document
string text = pdf.ExtractText();
// Print the extracted text to the console
Console.WriteLine(text);
' Extract text from the loaded PDF document
Dim text As String = pdf.ExtractText()
' Print the extracted text to the console
Console.WriteLine(text)
使用上述程式碼,您可以從PDF文件中提取文字。
使用IronPDF從PDF中提取文字
步驟5:將PDF光柵化為圖像
讓我們使用IronPDF將PDF文件光柵化為圖像。 首先,匯入所需的程式庫:
using System.Linq;
using IronPdf;
using IronSoftware.Drawing;
using System.Linq;
using IronPdf;
using IronSoftware.Drawing;
Imports System.Linq
Imports IronPdf
Imports IronSoftware.Drawing
然後程式碼使用RasterizeToImageFiles方法將PDF文件的所有頁面提取到資料夾中作為圖像文件。 提取的圖像可以保存為PNG或JPG文件,並且可以指定圖像的尺寸和頁面範圍。
// Extract all pages to a folder as image files with PNG format
pdf.RasterizeToImageFiles(@"C:\image\folder\*.png");
// Extract all pages to JPG images with specified dimensions
pdf.RasterizeToImageFiles(@"C:\image\folder\example_pdf_image_*.jpg", 100, 80);
// Extract all pages to a folder as image files with PNG format
pdf.RasterizeToImageFiles(@"C:\image\folder\*.png");
// Extract all pages to JPG images with specified dimensions
pdf.RasterizeToImageFiles(@"C:\image\folder\example_pdf_image_*.jpg", 100, 80);
' Extract all pages to a folder as image files with PNG format
pdf.RasterizeToImageFiles("C:\image\folder\*.png")
' Extract all pages to JPG images with specified dimensions
pdf.RasterizeToImageFiles("C:\image\folder\example_pdf_image_*.jpg", 100, 80)
最後,程式碼使用AnyBitmap物件,這些物件可以在程式碼中進一步處理和操作。
// Extract all pages as AnyBitmap objects for further processing
AnyBitmap[] pdfBitmaps = pdf.ToBitmap();
// Extract all pages as AnyBitmap objects for further processing
AnyBitmap[] pdfBitmaps = pdf.ToBitmap();
' Extract all pages as AnyBitmap objects for further processing
Dim pdfBitmaps() As AnyBitmap = pdf.ToBitmap()
上述程式碼示範了如何使用IronPDF提取PDF文件的內容,並將提取的資料保存為圖像文件或AnyBitmap物件以進一步處理。
步驟7:操作PDF頁面
讓我們學習如何通過使用IronPDF操作PDF文件的頁面。
程式碼首先使用RemovePages方法從PDF文件中移除頁面2和3:
// Remove pages two and three from the PDF document
pdf.RemovePages(1, 2);
// Remove pages two and three from the PDF document
pdf.RemovePages(1, 2);
' Remove pages two and three from the PDF document
pdf.RemovePages(1, 2)
RemovePages方法需要兩個參數:要移除的起始頁碼(在本例中是頁面2,因為頁面編號從0開始,表示為1)和要移除的頁數(在本例中為2頁)。
步驟6:保存PDF文件
最後,您可以使用SaveAs方法將PDF文件保存到您的本地系統中。 以下是保存PDF文件的程式碼:
// Save the PDF document to a specified output path
pdf.SaveAs(outputPath);
// Save the PDF document to a specified output path
pdf.SaveAs(outputPath);
' Save the PDF document to a specified output path
pdf.SaveAs(outputPath)
IronPDF相容性
IronPDF高度相容於所有最新的.NET Framework,包括.NET 7。它還支援.NET Blazor和.NET MAUI,這是微軟為Web開發提供的最新產品。 程式庫與這些框架的相容性使開發者能夠將IronPDF無縫整合到他們的應用程式中,並利用其強大的功能。
IronPDF的主要功能之一是能夠在.NET Blazor和.NET MAUI中讀取PDF文件。 此功能使開發者能夠快速、輕鬆地從PDF文件中讀取和提取資料,並在.NET應用程式中使用它們。 此能力在處理大量資料時尤其有用。 開發者不需要其他程式庫即可在他們的.NET專案中使用IronPDF。
在IronPDF的網站上了解更多關於IronPDF在.NET Blazor中的應用和將IronPDF整合至.NET MAUI的資訊。
總結
總之,程式化讀取PDF文件在各種行業中至關重要。 IronPDF提供了一個綜合解決方案來處理此任務,提供了廣泛的功能來讀取、修改和從PDF文件中提取內容。IronPDF易於安裝和使用,只需幾個簡單步驟。
程式庫提供了方法來從PDF文件中提取文字、將PDF光柵化為圖像、操作頁面以及保存PDF文件。 無論您是程式化PDF處理的新手還是有經驗的開發者,IronPDF都是提升您技能的理想工具。
如果您正在尋找用於C#中讀取PDF文件的可靠且高效的解決方案,IronPDF值得一試,特別是其授權選項和價格資訊,以及提供的免費試用。 您可以在下圖中看到IronPDF提供的更多方案。 您可以選擇符合您需求的套件。
IronPDF授權價格
常見問題
我如何在C#中讀取PDF檔案?
您可以使用IronPDF,首先通過NuGet套件管理器在您的.NET專案中安裝它。然後,導入該程式庫並使用它來載入和讀取PDF文件,提取文字並在控制台中顯示。
哪些行業受益於程式化的PDF處理?
如金融、醫療、法律和教育等行業受益於程式化的PDF處理,因為它允許通過IronPDF等工具進行高效的資料分析、文件管理和任務自動化。
我如何使用C#從PDF文件中提取資料?
使用IronPDF,您可以通過載入PDF文件並利用ExtractText方法來程式化地讀取和處理內容,以從PDF文件中提取資料。
我可以在C#中將PDF文件轉換為圖片嗎?
是的,使用IronPDF,您可以使用RasterizeToImageFiles方法將PDF文件轉換為圖片,允許您將頁面儲存為PNG或JPG格式的圖片文件。
IronPDF是否相容最新的.NET框架?
IronPDF與所有最新的.NET框架相容,包括.NET 7。它還支持.NET Blazor和.NET MAUI,能夠整合到各種應用程式中。
我如何使用C#修改並保存PDF文件?
使用IronPDF對PDF文件進行修改後,您可以使用SaveAs方法來指定修改後文件的輸出路徑,以保存更改。
在.NET專案中使用PDF程式庫需要哪些步驟?
要在.NET專案中使用IronPDF,通過NuGet安裝該程式庫,將其導入到您的專案中,然後使用其功能來程式化地載入、讀取和操作PDF文件。
IronPDF是否需要其他程式庫來在.NET中處理PDF?
不,IronPDF是一個獨立的程式庫,不需要其他程式庫,這使得它易於整合到您的.NET專案中以進行全面的PDF處理。
IronPDF的PDF處理的主要功能有哪些?
IronPDF提供了文字提取、PDF光柵化為圖片、頁面操作以及與最新.NET框架的相容性等功能,使其成為在C#中處理PDF文件的強大工具。
IronPDF是否完全相容.NET 10?
是的,IronPDF開箱即用地支持.NET 10(以及早期版本如.NET 9、8、7、6)。您可以使用IronPDF在.NET 10中構建應用程式,無需特殊配置或變通方法。




