Read PDF Files in C#

テキストと画像の抽出は、一つのドキュメント形式から別の形式に移行する際にデータの移行を容易にすることができます。 抽出されたコンテンツは、よりアクセスしやすく編集可能な形式で保存でき、データ損失のリスクを軽減します。

埋め込まれた画像とテキストは、PDFドキュメントから独立して抽出できます。 抽出されたテキストは通常の文字列であり、抽出された画像は画像バッファフォーマットであり、その後にエクスポートまたはさらに処理することができます。

テキストを抽出するために extractText メソッドを使用し、PDFドキュメントから画像を抽出するために extractRawImages メソッドを使用します。

これを行う方法の修正されたコメント付きの例を次に示します:

上記の C# コードでは:

  • IronPDF ライブラリを使用してPDFドキュメントを読み込みます。
  • ExtractText() メソッドは、PDFからテキストを取得するために呼び出されます。 このテキストはコンソールに出力されます。
  • ExtractImages() メソッドは、バイト配列に格納される画像を抽出するために使用されます。 各画像は、指定されたファイル名でファイルシステムに保存されます。

これらのメソッドの使用方法についての詳細な指示は、IronPDFドキュメントをご覧ください。

IronPDFでPDFテキストを読むの詳細を見る

準備はできましたか?
バージョン: 2026.6 リリースされたばかり
Still Scrolling Icon

まだスクロールしていますか?

すぐに証拠が欲しいですか?
サンプルを実行するHTML が PDF に変換されるのを確認します。