IRONSOFTWAREHOME
C# で PDF ファイルを読み取る
using IronPdf;
using IronSoftware.Drawing;
using System.Collections.Generic;

// Extracting Image and Text content from Pdf Documents

// open a 128 bit encrypted PDF
var pdf = PdfDocument.FromFile("encrypted.pdf", "password");

// Get all text to put in a search index
string text = pdf.ExtractAllText();

// Get all Images
var allImages = pdf.ExtractAllImages();

// Or even find the precise text and images for each page in the document
for (var index = 0 ; index < pdf.PageCount ; index++)
{
    int pageNumber = index + 1;
    text = pdf.ExtractTextFromPage(index);
    List<AnyBitmap> images = pdf.ExtractBitmapsFromPage(index);
    //...
}
Imports IronPdf
Imports IronSoftware.Drawing
Imports System.Collections.Generic

' Extracting Image and Text content from Pdf Documents

' open a 128 bit encrypted PDF
Dim pdf = PdfDocument.FromFile("encrypted.pdf", "password")

' Get all text to put in a search index
Dim text As String = pdf.ExtractAllText()

' Get all Images
Dim allImages = pdf.ExtractAllImages()

' Or even find the precise text and images for each page in the document
For index As Integer = 0 To pdf.PageCount - 1
    Dim pageNumber As Integer = index + 1
    text = pdf.ExtractTextFromPage(index)
    Dim images As List(Of AnyBitmap) = pdf.ExtractBitmapsFromPage(index)
    '...
Next
NuGet Download
PM > Install-Package IronPdf
C# で PDF ファイルを読み取る

C# で PDF ファイルを読み取る

IronPDF C# PDFライブラリのPdfDocument.ExtractAllTextメソッドは、素のPDFテキスト読み取りタスクに最適です。 このメソッドは、ソースPDFドキュメント内の空白やエンコーディングの不一致を問題なく処理します。

PdfDocument.ExtractTextFromPageはPDFの特定のページからテキストを読み取ります。 以下の例では、特定のページ範囲からテキストコンテンツを取得するために反復的に使用されている様子が示されています。

IronPDF は PDF から生データとして画像を抽出することもできます。 これには、以下のPdfDocumentクラスのいずれかのメソッドを使用します:

  • ExtractAllImages: IronSoftware.Drawing.AnyBitmapオブジェクトとしてPDFに埋め込まれたすべての画像を返します。
  • ExtractAllRawImages: 埋め込まれたすべての画像を生のバイトリストbyte[]として取得します。
  • ExtractImagesFromPage: インデックス付きページに含まれる画像を抽出します。
  • ExtractImagesFromPages: ExtractImagesFromPageと同じですが、特定のページ範囲または個々のページリストから抽出します。
  • ExtractRawImagesFromPages: 前の2つのメソッドと同じように機能しますが、IronSoftware.Drawing.AnyBitmapオブジェクトではなく、抽出された画像をバイト配列として返します。

Learn more about ExtractTextFromPage Method
GitHubで見る

準備はできましたか?

Nuget Downloads 20,809,720バージョン:2026.9リリースされたばかり

Key in blue circle

無料の30日間トライアルキーをすぐに入手してください。

Your trial license will be sent to your email address

制限なし。100% ロック解除済み。クレジットカード不要。

bullet_checkedクレジットカードやアカウントの作成は不要です。制限なし。100% ロック解除済み。クレジットカード不要。
  • Logo Aetna
  • Logo NASA
  • Logo GE
  • Logo Porsche
  • Logo USDA
  • Logo Qatar
Join Millions of Engineers who’ve tried IronPDF
無料のライブデモを予約する
Booking Badge

世界中の数百万人のエンジニアから信頼されています。

ライセンスはより安く
義務のない相談を受ける
下記のフォームを記入するか、sales@ironsoftware.comにメールしてください。
あなたの詳細は常に守秘されます。
世界中の数百万人のエンジニアから信頼されています。
ライセンスはより安く
あなたの無料30日間の試用キーをすぐに入手。
クレジットカードやアカウントの作成は不要です。