
PDFファイルのパスワードを削除する方法
あなたのビジネスはPDFセキュリティとコンプライアンスのための年間サブスクリプションに過剰に費やしていますか。それでは<IronSecureDoc>をご検討ください。デジタル署名、編集、暗号化、保護などのSaaSサービスの管理を一度の支払いで提供します。IronSecureDocについてさらに学ぶ
PDFからデータを抽出することは、手動入力の時間を節約するために重要です。 この記事では、IronPDFライブラリを使用してPDF文書からテキストと画像を抽出する方法を説明します。
C# で PDF からデータを抽出する方法
- PDFからデータを抽出するC#ライブラリをダウンロードする。
- Visual Studioで新しいプロジェクトを作成する
- プロジェクトにライブラリをインストールする
- 特定のページからデータを抽出し、PDFから特定のデータを抽出する。
- PDF ドキュメントからデータ出力を表示
IronPDF: C# PDFライブラリ
IronPDFは、PDFファイルを作成、編集、変換するために使用できる.NETライブラリです。 それは、開発者が自分のアプリケーションで使用するための使いやすいAPIを提供します。 それは、グローバルにPDFファイルを作成、編集、変換するための最も人気のあるライブラリの1つです。 IronPDFを使用すると、PDFに対する簡単で迅速なソリューションを作成できます。 各文書のためにカスタマイズされます、レイアウトは簡単に読めるように設定され、グラフィックは付随する.NETプログラムの助けを借りて設計されます。
IronPDFライブラリは、PDFファイルからデータを抽出するための素晴らしい機能を持っています。 この記事では、IronPDFを使用してデータを抽出する方法を見ていきます。 まず、C#プロジェクトを作成または開く必要があります。 次のセクションに進みましょう。
Visual StudioでC#プロジェクトを作成または開く
このチュートリアルでは、最新のVisual Studioバージョンを使用することをお勧めします。
Visual Studioが開いたら、以下の手順に従って新しいC#プロジェクトを作成してください。 既存のプロジェクトがあり、そのプロジェクトを使用したい場合は、次の手順をスキップして直接次のセクションに進んでください。
- Visual Studioを開きます
- "新しいプロジェクトを作成"ボタンをクリックします。
Visual Studioの起動画面
- テンプレートから"C#コンソールアプリケーション"を選択します。
新しいプロジェクトを作成する
- プロジェクトに名前を付け、次へボタンをクリックします。
- プロジェクトの要件に応じた.NET Frameworkを選択し、作成ボタンをクリックします。
.NETフレームワークの選択
Visual Studioは今、新しいC# .NETプロジェクトを生成します。
IronPDFライブラリをインストールする
IronPDFライブラリは、さまざまな方法でインストールできます。
パッケージマネージャコンソールの使用
- ツール > NuGetパッケージマネージャー > パッケージマネージャーコンソールに移動して、パッケージマネージャーコンソールを開きます。
- IronPDFライブラリをインストールするために次のコマンドを実行します:
パッケージマネージャーコンソールタブでのインストール進行状況
インストール後、以下のようにソリューションエクスプローラーのdependenciesセクションにIronPDFの依存関係が表示されます。
ソリューションエクスプローラーでIronPDFパッケージを参照
NuGetパッケージマネージャーを使用する
IronPDFライブラリをインストールするもう一つの方法は、Visual Studioの統合されたNuGetパッケージマネージャーUIを使用することです。
- メインメニューからツールに移動します。 ドロップダウンメニューから"NuGetパッケージマネージャー"にホバーし、"ソリューション用のNuGetパッケージを管理..."を選択します。
NuGetパッケージマネージャへのナビゲート
- これにより、NuGetパッケージマネージャウィンドウが開きます。 ブラウズタブに移動し、検索に
IronPdfと入力してEnterを押します。 - 検索結果からIronPDFを選択し、"インストール"ボタンをクリックしてインストールを開始します。
NuGetパッケージマネージャーからIronPDFパッケージをインストール
PDFファイルからデータを抽出する
以下のコードを見て、IronPDFを使用してデータを抽出する方法を見てみましょう:
// Import necessary namespaces
using IronPdf;
using System.Collections.Generic;
using System.Drawing;
public class PDFExtractor
{
public void ExtractDataFromPDF()
{
// Open a 128-bit encrypted PDF file by providing the filename and password
using PdfDocument pdf = PdfDocument.FromFile("encrypted.pdf", "password");
// Extract all text from the PDF document
string allText = pdf.ExtractAllText();
// Extract all images from the PDF document
IEnumerable<Image> allImages = pdf.ExtractAllImages();
// Iterate over each page in the PDF document
for (var index = 0; index < pdf.PageCount; index++)
{
int pageNumber = index + 1;
// Extract text from the specific page
string text = pdf.ExtractTextFromPage(index);
// Extract images from the specific page
IEnumerable<Image> images = pdf.ExtractImagesFromPage(index);
// Code to process the extracted text and images
//...
}
}
}' Import necessary namespaces
Imports IronPdf
Imports System.Collections.Generic
Imports System.Drawing
Public Class PDFExtractor
Public Sub ExtractDataFromPDF()
' Open a 128-bit encrypted PDF file by providing the filename and password
Using pdf As PdfDocument = PdfDocument.FromFile("encrypted.pdf", "password")
' Extract all text from the PDF document
Dim allText As String = pdf.ExtractAllText()
' Extract all images from the PDF document
Dim allImages As IEnumerable(Of Image) = pdf.ExtractAllImages()
' Iterate over each page in the PDF document
For index = 0 To pdf.PageCount - 1
Dim pageNumber As Integer = index + 1
' Extract text from the specific page
Dim text As String = pdf.ExtractTextFromPage(index)
' Extract images from the specific page
Dim images As IEnumerable(Of Image) = pdf.ExtractImagesFromPage(index)
' Code to process the extracted text and images
'...
Next index
End Using
End Sub
End Classこのコード例では:
FromFileメソッドは、パスワードが必要な暗号化された入力PDFドキュメントを読み込むために使用されます。ExtractAllTextメソッドはPDFからすべてのテキストコンテンツを抽出します。ExtractAllImagesメソッドはすべての埋め込み画像を取得します。- ループは文書の各ページを反復して、その特定のページから
ExtractImagesFromPageを使用してテキストと画像を抽出します。
結論
IronPDFを使用すると、開発者は簡単にPDFファイルからテキストと画像を抽出できます。 ExtractAllImagesを使用することで、PDFファイルのすべての内容を即座に抽出できます。 また、これらのメソッドを使用して特定のページから内容を抽出することもできます。 前述のコードでは、これらのメソッドを使って複数のページからテキストと画像を読み取る方法を示しました。
さらに、IronPDFは、チャートの描画、バーコードを追加、パスワードでセキュリティを強化、透かしをプログラムでPDFフォームを処理する機能などを提供します。
IronPDFは、開発中は無料で利用可能であり、商業利用には支払いが必要です。 商業利用での支払いなしでIronPDFの無料トライアルが利用可能です。
2つのIronPDF Lite Licensesの費用で[Iron Softwareのドキュメントライブラリのフルスイート](Iron Suite)を購入してください。
今日からPDFからデータを抽出を開始するために、IronPDFを今すぐダウンロードしてください!

Curtis Chauは、カールトン大学でコンピュータサイエンスの学士号を取得し、Node.js、TypeScript、JavaScript、およびReactに精通したフロントエンド開発を専門としています。直感的で美しいユーザーインターフェースを作成することに情熱を持ち、Curtisは現代のフレームワークを用いた開発や、構造の良い視覚的に魅力的なマニュアルの作成を楽しんでいます。
関連する記事


