"# 使用 ExtractTextFromPage 新增書籤"

當您根據文字內容新增書籤時,使用Pages.Lines屬性進行搜尋可能會失敗,因為返回的文字可能會出現混亂或順序錯誤,因此基於標題的搜尋無法匹配。 使用ExtractTextFromPage()提取頁面文字,按邏輯順序讀取每頁,並提供可靠的字串以供搜尋。

請注意在版本2026.5.x及以上,使用LinkAnnotation類別。 "它內建支持可點擊的鏈結,導航到特定頁面和位置,並且是可用時的建議方法。)]}"

Pages.Lines從文字在頁面上的視覺顯示方式重新構建文字。 "當文字以非線性順序繪製時,當自定義字型或編碼起作用時,或當 PDF 是從 HTML 或具有複雜佈局的第三方工具生成時,這會分解。" "結果是無法依賴於搜索的文字不完整或混亂。"

解決方案

1. 使用ExtractTextFromPage()閱讀每頁

"從每個頁面提取原始嵌入文字,而不是視覺重建。" ExtractTextFromPage()以邏輯閱讀順序返回頁面內容,這讓標題搜尋在各種PDF結構間更加可靠。

"### 2. 遍歷每個頁面並為每個唯一的標題新增書籤"

"遍歷所有頁面,以便不會錯過任何部分,無論它落在哪裡,並跟踪您已經看到的標題,因此每個標題只標記一次書籤。" "ARTICLE 1", "ARTICLE 2"的各部分時,它保證每篇文章只有一個書籤。

"輸出是一組指向每個指定標題的書籤,即使 PDF 來自動態的 HTML 來源或具有複雜的格式。"

使用ExtractTextFromPage和HashSet在每個文章標題上新增PDF書籤的C#程式碼

Curtis Chau
技術作家

Curtis Chau擁有Carleton大學的電腦科學學士學位,專精於前端開發,擁有Node.js、TypeScript、JavaScript和React的專業知識。Curtis熱衷於建立直觀且美觀的使用者介面,喜愛使用現代框架並建立結構良好、視覺吸引力的手冊。

除了開發,Curtis對物聯網(IoT)有濃厚的興趣,探索創新的方法來整合硬體和軟體。在空閒時間,他喜歡玩遊戲和建立Discord機器人,結合他對技術的熱愛與創造力。

準備開始了嗎?
Nuget 下載 20,296,129 | 版本: 2026.7 剛剛發布
Still Scrolling Icon

還在捲動嗎?

想快速獲得證明嗎? PM > Install-Package IronPdf
執行範例 看您的HTML變成PDF。