C# で PDF ファイルを読み取る

IronPDF C# PDFライブラリのPdfDocument.ExtractAllTextメソッドは、素のPDFテキスト読み取りタスクに最適です。 このメソッドは、ソースPDFドキュメント内の空白やエンコーディングの不一致を問題なく処理します。

PdfDocument.ExtractTextFromPageはPDFの特定のページからテキストを読み取ります。 以下の例では、特定のページ範囲からテキストコンテンツを取得するために反復的に使用されている様子が示されています。

IronPDF は PDF から生データとして画像を抽出することもできます。 これには、以下のPdfDocumentクラスのいずれかのメソッドを使用します:

  • ExtractAllImages: IronSoftware.Drawing.AnyBitmapオブジェクトとしてPDFに埋め込まれたすべての画像を返します。
  • ExtractAllRawImages: 埋め込まれたすべての画像を生のバイトリストbyte[]として取得します。
  • ExtractImagesFromPage: インデックス付きページに含まれる画像を抽出します。
  • ExtractImagesFromPages: ExtractImagesFromPageと同じですが、特定のページ範囲または個々のページリストから抽出します。
  • ExtractRawImagesFromPages: 前の2つのメソッドと同じように機能しますが、IronSoftware.Drawing.AnyBitmapオブジェクトではなく、抽出された画像をバイト配列として返します。

Learn more about ExtractTextFromPage Method

準備はできましたか?
Nuget ダウンロード 20,296,129 | バージョン: 2026.7 リリースされたばかり
Still Scrolling Icon

まだスクロールしていますか?

すぐに証拠が欲しいですか? PM > Install-Package IronPdf
サンプルを実行するHTML が PDF に変換されるのを確認します。