IRONSOFTWAREHOME
PDF ツール

PDF文書でページを削除する方法

Curtis Chau
Curtis Chau
Updated: 2026年7月19日

現代のソフトウェアプロジェクトにおいて、PDFドキュメントからテキストを抽出することは一般的な要求です—請求書の処理から、検索エンジンのためのコンテンツマイニングまで。 開発者は、正確な結果を提供するだけでなく、C# .NETアプリケーションにおいて効率的な統合体験を提供する信頼できるライブラリを必要としています。 一部の開発者はOCR(光学式文字認識)ツールを使用してスキャンされたドキュメントや画像からデータを抽出しますが、時には強力なテキスト抽出ツールが必要な場合があります。

しかし、市場にはいくつものPDFライブラリがあるため、適切なツールを選ぶことは圧倒されることもあります。 話題に上ることが多い2つのライブラリは、iTextIronPDFです。 どちらもPDFからのテキスト抽出が可能ですが、使いやすさ、サポート、性能、および価格において大きな違いがあります。 この記事では、テキスト抽出処理をどのように取り扱うかを示す異なるコードサンプルを使って、これら2つのライブラリを比較し、プロジェクトに最も適した選択肢を決めるための手助けをします。

IronPDFとiTextライブラリの概要

iTextは、.NET向けの長年人気のあるオープンソースPDFライブラリで、コンテンツの生成、操作、および抽出のための強力なツールを提供しています。 JavaベースのiTextのC#ポートとして、PDF構造に対する深い制御を提供し、高度なユーザーに理想的です。 しかし、この柔軟性には急な学習曲線とライセンス制約が伴います; 商業利用にはAGPLの義務を避けるための有料ライセンスが必要となることが多いです。

IronPDFの登場—.NET向けに構築された現代的で開発者に優しいPDFライブラリ。 直感的なAPI、明確なドキュメント、そして応答性の高いサポートにより、テキスト抽出のような一般的なタスクを簡素化します。 このツールを使用すると、画像やPDFドキュメントからテキストを簡単に抽出したり、新しいPDFファイルを作成したり、PDFセキュリティを実装したりすることができます。

iTextとは異なり、IronPDFは複雑な低レベル構造を避け、より迅速かつ効率的な作業を可能にします。 1ページの処理であれ何百ものPDFであれ、それを簡単に保ちます。

また、定期的な更新とライセンスモデルを採用しており、無料の試用版やチームや個人開発者向けの手頃なプランを提供しています。

IronPDFのインストールと使用

IronPDFは、NuGet Package Manager Consoleで次のコマンドを実行することでNuGet経由でインストールできます。

PM > Install-Package IronPdf

または、NuGetパッケージマネージャでソリューション画面からインストールすることができます。 これを行うには、"ツール > NuGetパッケージマネージャ > ソリューションのNuGetパッケージを管理"へ移動します。 その後、"IronPDF"を検索し、"インストール"をクリックします。

IronPDFでPDFファイルからテキストを抽出

インストール後、テキスト抽出は簡単です:

using IronPdf;

// Load the PDF document
var pdf = PdfDocument.FromFile("invoice.pdf");

// Extract text from the PDF
string extractedText = pdf.ExtractAllText();

// Output the extracted text
Console.WriteLine(extractedText);

**注:**このメソッドは、PDFファイル全体を読み込み、テキストを読み取り順に返し、従来のライブラリと比べて解析時間を数時間節約できます。

エンコーディング、コンテンツストリーム、または手動解析を扱う必要はありません。 IronPDFは内部でこれらすべてを処理し、最小限のセットアップでクリーンで正確な出力を提供します。その後、抽出したテキストを新しいテキストファイルに簡単に保存し、さらなる操作や使用が可能です。

iText PDFライブラリのインストール

PDF生成用にiTextのコアパッケージをダウンロードするには、次のコマンドを使用します:

PM > Install-Package iTextSharp

ソリューション画面のパッケージマネージャーを介してもiTextをインストールできます。 これを行うには、まずツールドロップダウンメニューを開き、"NuGet パッケージ マネージャ > ソリューションの NuGet パッケージを管理"を見つけます。 その後、ただiTextを検索して、"インストール"をクリックするだけです。

PDFドキュメントからiTextでテキストを抽出する

単一のPDFページからテキストを抽出するサンプルはこちら:

using iText.Kernel.Pdf;
using iText.Kernel.Pdf.Canvas.Parser;
using iText.Kernel.Pdf.Canvas.Parser.Listener;

// Define the path to your PDF
string path = "sample.pdf";

// Open the PDF reader and document
using (PdfReader reader = new PdfReader(path))
using (PdfDocument pdf = new PdfDocument(reader))
{
    // Use a simple text extraction strategy
    var strategy = new SimpleTextExtractionStrategy();
    
    // Extract text from the first page
    string pageText = PdfTextExtractor.GetTextFromPage(pdf.GetPage(1), strategy);
    
    // Output the extracted text
    Console.WriteLine(pageText);
}

この例はiTextの能力を示していますが、簡単な作業を行う際の冗長性と追加オブジェクトに注意してください。

詳細な比較

今やインストールと基本的な使用法をカバーしたので、これらの2ライブラリが多ページのPDFドキュメントからテキストを抽出する方法の詳細な比較を見てみましょう。

高度な例: IronPDFを使用してページ範囲からテキストを抽出する

IronPDFはページ選択とレイアウト認識のテキスト抽出に対する細かい制御をサポートします。

using IronPdf;

// Load the PDF document
var pdf = PdfDocument.FromFile("longPdf.pdf");

// Define the page numbers to extract text from
int[] pages = new[] { 2, 3, 4 };

// Extract text from the specified pages
var text = pdf.ExtractTextFromPages(pages);

// Output the extracted text
Console.WriteLine("Extracted text from pages 2, 3, and 4:\n" + text);

高度な例:iTextを使用してページ範囲からテキストを抽出する

iTextでは、PdfTextExtractorを使用してページ範囲を手動で指定し、テキストを抽出する必要があります:

using iTextSharp.text.pdf;
using iTextSharp.text.pdf.parser;
using System.IO;
using System.Text;

// Load the PDF document
PdfReader reader = new PdfReader("longPdf.pdf");
StringBuilder textBuilder = new StringBuilder();

// Extract text from pages 2–4
for (int i = 2; i <= 4; i++)
{
    string pageText = PdfTextExtractor.GetTextFromPage(reader, i, new LocationTextExtractionStrategy());
    textBuilder.AppendLine(pageText);
}

// Output the extracted text
Console.WriteLine(textBuilder.ToString());

// Close the PDF reader
reader.Close();

コード比較の概要

IronPDFとiTextはどちらも高度なPDFテキスト抽出が可能ですが、そのアプローチは複雑さと明確さにおいて大きく異なります。

  • IronPDFは、クリーンで誰にでもアクセスしやすいです。 その高レベルのメソッドPdfDocument.ExtractAllText()は、最小限のセットアップで構造化されたコンテンツを抽出できるため、コードがシンプルで、PDF処理の初心者の開発者でも実装が簡単です。

  • iTextは、特にPDFの構造についての深い理解が必要です。 テキストを抽出するには、カスタムレンダリングリスナーの設定、ページの手動管理、レイアウトデータの行ごとの解釈が必要になります。強力ではありますが、冗長で直感的ではなく、IronPDFがほとんど for .NETプロジェクトにとってより迅速でメンテナンスしやすいオプションとなります。

しかし、我々の比較はここで終わりではありません。 次に、これらの2つのライブラリが他の分野でどのように比較されるかを見ていきましょう。

詳細比較: IronPDF vs iText

C#でのPDFテキスト抽出ライブラリを評価する際、開発者はしばしばシンプルさ、性能、長期的サポート間のバランスを考慮します。 IronPDFとiTextが、特にC#でPDFからテキストを抽出する際の実際の使用方法でどのように比較されるかを分析しましょう。

1. 使いやすさ

IronPDF:クリーンで現代的なAPI

IronPDFは開発者の体験を重視しています。 NuGetから簡単にインストールでき、シンタックスも直感的です:

using IronPdf;

// Load the PDF
var pdf = PdfDocument.FromFile("sample.pdf");

// Extract all text from every page
string extractedText = pdf.ExtractAllText();

// Output the extracted text
Console.WriteLine(extractedText);

IronPDFは、ExtractAllText()のようなシンプルなメソッド呼び出しの背後に複雑さを抽象化し、ボイラープレートや解析ロジックを必要としません。

iText: より冗長で低レベル

iTextは各ページの手動解析が必要で、プレーンテキストを抽出するにはより多くの労力が必要です。

using iTextSharp.text.pdf;
using iTextSharp.text.pdf.parser;
using System.IO;
using System.Text;

// Load the PDF
var reader = new PdfReader("sample.pdf");
StringBuilder text = new StringBuilder();

for (int i = 1; i <= reader.NumberOfPages; i++)
{
    text.Append(PdfTextExtractor.GetTextFromPage(reader, i));
}

// Output the extracted text
Console.WriteLine(text.ToString());

開発者はページを手動でループする必要があり、エッジケースが発生するとバグの可能性が高まります。

2. 性能と信頼性

  • IronPDFは現代のレンダリングエンジン(Chromium)に基づいて構築されており、埋め込みフォント、回転テキスト、複数のレイアウトを持つ現代的なPDFに適してします。 テキスト抽出はレイアウト認識があり、より自然にスペースを保ちます。

  • iTextは強力ですが、複雑なフォーマットには苦労する可能性があります。 混在した向きや非標準のエンコーディングを持つPDFファイルは、文字化けや順序の誤ったテキストを生成する可能性があります。

3. コストとライセンス

機能IronPDFiText
ライセンスタイプ商業(無料トライアルあり)AGPL(無料)/商用(有料)
価格の透明性公開価格 & 永続的ライセンス複雑なティアおよび再配布ルール
サポート専用サポートチームコミュニティサポート(ライセンスがない場合)
クローズドソースアプリでの使用はい(ライセンス付き)AGPLではない
ご注意: 商用または専用ソフトウェアを構築している場合、iText AGPLはコードをオープンソースにするか、商用ライセンスを購入する必要があります。 IronPDFは、クローズドソースプロジェクトに対してより柔軟なライセンスモデルを提供します。)]

4. 開発者サポートとドキュメント

  • **IronPDF:**最新のドキュメント、ビデオ チュートリアル、迅速なチケットベースのサポートが付属しています。

  • iText: 良好なドキュメンテーションがあり、特に有料顧客でない限り、無料サポートは限られています。

5. クロスライブラリのまとめ

基準IronPDFiText
単純さ高 – ワンライナーのテキスト抽出中規模 – 手動ページの反復
性能高速で現代的な解析複雑なPDFやスキャンされたPDFでは遅くなります
商業対応はい、AGPL制限なしクローズドソースアプリではAGPLが制約
サポートとドキュメント専用、応答的コミュニティ依存
.NET CoreサポートFull満杯

結論

C#でPDFからテキストを抽出する際、IronPDFとiTextはどちらも有能なツールですが、異なるタイプの開発者向けに設計されています。 もし現代的で、統合が簡単で、優れたサポートを持ち、積極的に維持され、レイアウトの保存がスムーズなソリューションを探しているなら、IronPDFが明らかに際立っています。 これは開発時間を短縮し、直感的なAPIを提供し、.NETフレームワーク内のさまざまなアプリケーション、ウェブアプリからエンタープライズシステムにまで広く対応します。

一方で、iTextは、既にそのエコシステムに組み込まれている開発者や、テキスト抽出戦略に詳細な制御が必要な者には強力な選択肢です。 しかし、その急な学習曲線と商業サポートの欠如は、迅速にスケールする必要があるプロジェクトや清潔なコードベースを維持するプロジェクトを遅らせる可能性があります。

.NET開発者が速度、明確さ、信頼できる結果を重視する場合、IronPDFは未来を見据えた道を提供します。 ドキュメント自動化ツール、検索エンジン、内部ダッシュボードを構築しているかどうかにかかわらず、IronPDFの強力な機能と性能は、より迅速かつスマートな成果を達成するのに役立ちます。

無料トライアル版をダウンロードして、IronPDFを今すぐお試しください。 無料トライアルと開発者に優しいAPIを使えば、数分で始められます。

[[i: (iTextはその所有者の登録商標です。 このサイトは、iTextと提携しておらず、承認されてもおらず、後援されてもいません。 すべての製品名、ロゴ、およびブランドは各所有者の所有物です。 比較は情報提供のみを目的としており、執筆時点で公開されている情報を反映しています。)]]

Curtis Chau
テクニカルライター

Curtis Chauは、カールトン大学でコンピュータサイエンスの学士号を取得し、Node.js、TypeScript、JavaScript、およびReactに精通したフロントエンド開発を専門としています。直感的で美しいユーザーインターフェースを作成することに情熱を持ち、Curtisは現代のフレームワークを用いた開発や、構造の良い視覚的に魅力的なマニュアルの作成を楽しんでいます。

...
詳しく読む

関連する記事

Key in blue circle

無料の30日間トライアルキーをすぐに入手してください。

Your trial license will be sent to your email address

制限なし。100% ロック解除済み。クレジットカード不要。

bullet_checkedクレジットカードやアカウントの作成は不要です。制限なし。100% ロック解除済み。クレジットカード不要。
  • Logo Aetna
  • Logo NASA
  • Logo GE
  • Logo Porsche
  • Logo USDA
  • Logo Qatar
Join Millions of Engineers who’ve tried IronPDF
無料のライブデモを予約する
Booking Badge

世界中の数百万人のエンジニアから信頼されています。

ライセンスはより安く
義務のない相談を受ける
下記のフォームを記入するか、sales@ironsoftware.comにメールしてください。
あなたの詳細は常に守秘されます。
世界中の数百万人のエンジニアから信頼されています。
ライセンスはより安く
あなたの無料30日間の試用キーをすぐに入手。
クレジットカードやアカウントの作成は不要です。