"# 使用 ExtractTextFromPage 新增書籤"
當您根據文字內容新增書籤時,使用Pages.Lines屬性進行搜尋可能會失敗,因為返回的文字可能會出現混亂或順序錯誤,因此基於標題的搜尋無法匹配。 使用ExtractTextFromPage()提取頁面文字,按邏輯順序讀取每頁,並提供可靠的字串以供搜尋。
LinkAnnotation類別。 "它內建支持可點擊的鏈結,導航到特定頁面和位置,並且是可用時的建議方法。)]}"
Pages.Lines從文字在頁面上的視覺顯示方式重新構建文字。 "當文字以非線性順序繪製時,當自定義字型或編碼起作用時,或當 PDF 是從 HTML 或具有複雜佈局的第三方工具生成時,這會分解。" "結果是無法依賴於搜索的文字不完整或混亂。"
解決方案
1. 使用ExtractTextFromPage()閱讀每頁
"從每個頁面提取原始嵌入文字,而不是視覺重建。" ExtractTextFromPage()以邏輯閱讀順序返回頁面內容,這讓標題搜尋在各種PDF結構間更加可靠。
"### 2. 遍歷每個頁面並為每個唯一的標題新增書籤"
"遍歷所有頁面,以便不會錯過任何部分,無論它落在哪裡,並跟踪您已經看到的標題,因此每個標題只標記一次書籤。" "ARTICLE 1", "ARTICLE 2"的各部分時,它保證每篇文章只有一個書籤。
"輸出是一組指向每個指定標題的書籤,即使 PDF 來自動態的 HTML 來源或具有複雜的格式。"


