IRONSOFTWAREHOME
テキストを抽出
from ironpdf import *

# Load existing PDF document
pdf = PdfDocument.FromFile("content.pdf")

# Extract text from PDF document
all_text = pdf.ExtractAllText()

# Extract text from specific page in the document
page_2_text = pdf.ExtractTextFromPage(1)
pip install ironpdf
テキストを抽出

テキストを抽出

IronPDF for Pythonは、ExtractTextFromPageメソッドを使用して、PDFドキュメントのテキストコンテンツをドキュメント全体または個々のページから抽出できます。

開始方法

PdfDocument.FromFileを使ってロードし、適切な抽出メソッドを呼び出します。 どちらのメソッドも、抽出されたテキストを含むPythonの文字列を返します。

コードの理解

  • PdfDocument.FromFile(path):指定されたファイルパスから既存のPDFドキュメントを開きます。 パスワード保護されたファイルの場合、2つ目の引数としてパスワードを渡します。
  • ExtractAllText():ドキュメントのすべてのページから抽出されたテキストをページ順に単一の文字列として返します。
  • ExtractTextFromPage(pageIndex):単一ページのテキストコンテンツを返します。 1を渡して使用します。

使用例

テキスト抽出は次の用途に役立ちます。

  • 検索インデックス化 - PDFコンテンツをデータベースまたは検索エンジンで検索できるようにします。
  • データ解析 - PDFレポートから請求番号、日付、住所などの構造化データを抽出します。
  • コンテンツの検証 - 生成されたPDFに期待するテキストが含まれているかをプログラムでチェックします。
  • アクセシビリティ - スクリーンリーダーや後処理用にPDFコンテンツをプレーンテキストに変換します。
IronPDF for Pythonを使用してPDFからコンテンツを抽出する方法を学びましょう!

準備はできましたか?

バージョン:2026.9リリースされたばかり

Key in blue circle

無料の30日間トライアルキーをすぐに入手してください。

Your trial license will be sent to your email address

制限なし。100% ロック解除済み。クレジットカード不要。

OR
bullet_checkedクレジットカードやアカウントの作成は不要です。制限なし。100% ロック解除済み。クレジットカード不要。
  • Logo Aetna
  • Logo NASA
  • Logo GE
  • Logo Porsche
  • Logo USDA
  • Logo Qatar
Join Millions of Engineers who’ve tried Iron Suite
無料のライブデモを予約する
Booking Badge

世界中の数百万人のエンジニアから信頼されています。

ライセンスはより安く
義務のない相談を受ける
下記のフォームを記入するか、sales@ironsoftware.comにメールしてください。
あなたの詳細は常に守秘されます。
世界中の数百万人のエンジニアから信頼されています。
ライセンスはより安く
あなたの無料30日間の試用キーをすぐに入手。
クレジットカードやアカウントの作成は不要です。
PDF用Pythonモジュールダウンロード
pipでインストール

バージョン: 2026.9

  1. ダウンロードしてPython 3.7+をインストールしてください。
  2. pipをインストールするにはpypi.orgからダウンロードしてください。
  3. 上記のコマンドをターミナルで実行します。
Python PDFモジュール
モジュールをダウンロード

バージョン: 2026.9

Manually install into your project

  1. パッケージをダウンロード
  2. ターミナルからこのコマンドを実行してください
    pip install ironpdf-2026.9-py37-none-win_amd64.whl

ライセンスは$999から