C# Select Case (How It Works For Developers)
什麼是ChatGPT?
ChatGPT是一款由OpenAI於2022年發佈的大型語言模型聊天機器人。它以能夠使使用者建立並形塑對話,使其達到所需的結構、風格、細節程度和語言而著稱。 每個討論點都考慮到前導提示和回應,或使用OpenAI API密鑰的'提示工程'。
ChatGPT的基礎由OpenAI專有的生成式預訓練轉換模型系列中的轉換模型組成。 這些模型隨後通過結合監督和強化學習方法進行優化以用於對話應用。 最初作為免費研究預覽發布,由於受歡迎程度,現ChatGPT AI語言模型由OpenAI提供為免費增值基礎上的服務。 較為複雜的基於GPT-4的版本和更新功能的優先存取提供給品牌名稱為'ChatGPT Plus'的付費客戶,而使用者可以使用GPT-3.5免費層級。
ChatGPT可以閱讀PDF文件嗎?
嗯,是和不是。有了付費版本,要求ChatGPT從PDF文件中提取文字就像將文件上傳到聊天框並要求它從中提取文字或總結PDF內容一樣簡單。
但是,它也有一些缺點。 ChatGPT將以純文字的形式提供資訊,這意味著利用這些資訊來建立新的PDF文件是一個手動過程。 可以要求ChatGPT從提取的文字中建立一個新的PDF文件,但在排版問題和下載連結故障上容易出問題。 同樣,ChatGPT在客製化方面是有限的,經常在請求向您的文件新增標題和頁尾時出現問題舉例。
在撰寫本文時,ChatGPT的免費層級不支持文件附件,這意味著不可能要求它閱讀PDF。
什麼是IronPDF?
IronPDF專門開發出來,旨在使在.NET框架下建立、瀏覽和編輯PDF文件變得簡單。 它包含強大的API以生成,編輯和修改PDF文件,此外還充當強大的PDF轉換器。 Xamarin,Blazor,Unity,HoloLens應用程式,Windows Forms,HTML,ASPX,Razor,.NET Core,ASP和WPF只是與IronPDF相容的擴展的一部分。
IronPDF利用Chrome引擎將HTML轉換為PDF。 它支持傳統的Windows程式和使用 Microsoft.NET和.NET Core的線上ASP.NET應用程式。 它允許您以多種功能自訂您的PDF,支持HTML5,JavaScript,CSS和圖像。
藉由利用IronPDF程式庫,開發者可以不使用Acrobat Reader來讀取和編輯PDF文件。 此外,他們可以新增文字和圖形,書籤,水印,頁眉和頁尾,以及分割和傳輸文字屬性,合併頁面和從新或現有PDF文件中提取圖像。
此外,可以使用CSS和CSS媒體文件生成PDF文件。 IronPDF允許您生成,更新和編輯新的辦公文件,如Microsoft Word以及過時的PDF表單。
使用IronPDF從PDF中提取文字
IronPDF允許您從PDF中提取文字並將其轉換為多種格式。 它可以處理單個或多個PDF文件,並允許您從整個文件或選定頁面中提取文字 - 使您對PDF內容擁有完全控制。 以下是如何入門:
在Visual Studio中建立您的項目
首先,打開Visual Studio,然後轉到File -> New Project -> Console Application。 輸入您的項目名稱,選擇您想要保存的位置,然後按下一步按鈕。 選擇最新的.NET Framework,然後建立。 一旦您的項目運行起來,就該新增我們的程式庫了。
安裝IronPDF程式庫
IronPDF易於使用,但更容易安裝。 您可以透過幾種方式來做到:
方法1:NuGet Package Manager控制台
在Visual Studio中,在Solution Explorer中,右鍵單擊參考,然後單擊管理NuGet套件。 點擊瀏覽並搜索'IronPDF',然後安裝最新版本。 如果您看到這個,說明它正在工作:

您還可以到工具 -> NuGet包管理器 -> 包管理器控制台,在包管理器選項卡中輸入以下行:
Install-Package IronPdf
最後,您可以在NuGet的官方網站上獲取IronPDF下載說明。 從頁面右側的選單中選擇下載軟體包選項,將下載的文件雙擊安裝即可,然後重新載入解決方案,在項目中開始使用它。
未能運作? 您可以在我們的進階NuGet安裝方式中找到針對特定平台的幫助。
方法2:使用DLL文件
您還可以直接從我們這裡獲得IronPDF DLL文件並手動將其新增到Visual Studio中。 要獲取完整的說明和Windows,MacOS和Linux DLL軟體包的連結,請查看我們專門的IronPDF安裝指南。
新增IronPDF命名空間
一定要記得用IronPDF命名空間開始您的程式碼,如下所示:
using IronPdf;
using IronPdf;
Imports IronPdf
從整個PDF文件中提取文字
從PDF文件中提取文字就像兩行程式碼一樣簡單。 在這個程式碼範例中,我們將PDF內容轉換為基於文字的格式:
// Load the PDF document from a file into a PdfDocument object
var pdfDocument = IronPdf.PdfDocument.FromFile("Demo.pdf");
// Extract all text from the entire PDF and store it in a string
string AllText = pdfDocument.ExtractAllText();
// Load the PDF document from a file into a PdfDocument object
var pdfDocument = IronPdf.PdfDocument.FromFile("Demo.pdf");
// Extract all text from the entire PDF and store it in a string
string AllText = pdfDocument.ExtractAllText();
' Load the PDF document from a file into a PdfDocument object
Dim pdfDocument = IronPdf.PdfDocument.FromFile("Demo.pdf")
' Extract all text from the entire PDF and store it in a string
Dim AllText As String = pdfDocument.ExtractAllText()
讓我們去了解一下 - FromFile()函式從您的電腦上載入PDF文件並將其轉化為PdfDocument物件。 從那裡,PdfDocument類物件的ExtractAllText()函式提取整個PDF文件的所有文字並將其儲存在可處理的字串中。
在下方,您可以在控制台中查看PDF和文字輸出:

從PDF文件中的個別頁面提取文字
using IronPdf;
// Load the PDF document from a file
PdfDocument PDF = PdfDocument.FromFile("result.pdf");
// Loop through each page of the PDF document
for (var index = 0; index < PDF.PageCount; index++)
{
// Page numbers are typically 1-based, so we add 1 to the index
int PageNumber = index + 1;
// Extract text from the current page
string Text = PDF.ExtractTextFromPage(index);
}
using IronPdf;
// Load the PDF document from a file
PdfDocument PDF = PdfDocument.FromFile("result.pdf");
// Loop through each page of the PDF document
for (var index = 0; index < PDF.PageCount; index++)
{
// Page numbers are typically 1-based, so we add 1 to the index
int PageNumber = index + 1;
// Extract text from the current page
string Text = PDF.ExtractTextFromPage(index);
}
Imports IronPdf
' Load the PDF document from a file
Private PDF As PdfDocument = PdfDocument.FromFile("result.pdf")
' Loop through each page of the PDF document
For index = 0 To PDF.PageCount - 1
' Page numbers are typically 1-based, so we add 1 to the index
Dim PageNumber As Integer = index + 1
' Extract text from the current page
Dim Text As String = PDF.ExtractTextFromPage(index)
Next index
類似於先前的程式碼,這裡整個PDF文件在轉換為PDF物件之前被載入。 for迴圈將頁面選項處理為參數。 從那裡,我們的文字被儲存在字串變數中。 為了逐頁提取PDF中的資訊,我們利用for迴圈。
如需更多關於如何從PDF中提取嵌入文字和圖像的資訊,請查看此從PDF中提取文字和圖像的詳細指南。
IronPDF與ChatGPT - 哪個更好?
有許多工具可以讓您從PDF中提取內容,包括ChatGPT。 然而,IronPDF以客製化和開發者控制為設計重點,使其成為業界領先的PDF閱讀器。 PDF閱讀僅僅是開始 - 通過HTML到PDF轉換、PDF格式化工具、內建安全和合規功能,IronPDF是一站式處理所有PDF文件需求的第一工具。
IronPDF也擁有廣泛的相容性。 為.NET生態系統構建,它支持.NET Framework,.NET Standard和.NET Core 3.1到8,並不斷更新以保持最新。
準備好親身體驗IronPDF了嗎? 您可以從我們的30天免費試用探索IronPDF功能開始。 它也完全免費用於開發目的,讓您可以真正看到它的價值。 如果您喜歡所見,IronPDF的完整工具起價僅需$999。 為了獲得更大幅度的節省,請查看Iron Suite套件提供9個工具只需兩個價格。 祝開發愉快!





