C# で PDF ファイルを読み取る
IronPDF C# PDFライブラリのPdfDocument.ExtractAllTextメソッドは、素のPDFテキスト読み取りタスクに最適です。 このメソッドは、ソースPDFドキュメント内の空白やエンコーディングの不一致を問題なく処理します。
PdfDocument.ExtractTextFromPageはPDFの特定のページからテキストを読み取ります。 以下の例では、特定のページ範囲からテキストコンテンツを取得するために反復的に使用されている様子が示されています。
IronPDF は PDF から生データとして画像を抽出することもできます。 これには、以下のPdfDocumentクラスのいずれかのメソッドを使用します:
ExtractAllImages:IronSoftware.Drawing.AnyBitmapオブジェクトとしてPDFに埋め込まれたすべての画像を返します。ExtractAllRawImages: 埋め込まれたすべての画像を生のバイトリストbyte[]として取得します。ExtractImagesFromPage: インデックス付きページに含まれる画像を抽出します。ExtractImagesFromPages:ExtractImagesFromPageと同じですが、特定のページ範囲または個々のページリストから抽出します。ExtractRawImagesFromPages: 前の2つのメソッドと同じように機能しますが、IronSoftware.Drawing.AnyBitmapオブジェクトではなく、抽出された画像をバイト配列として返します。
C#でPDFファイルを読み取る方法
- C#用IronPDFライブラリのダウンロード
- PDFから画像やテキストを抽出
- 特定の文書内の単語の読み取りと検索
- 原文のPDF出力を見る

