PDF-Dateien in C# lesen

Die PdfDocument.ExtractAllText-Methode aus der IronPDF C# PDF-Bibliothek ist ideal für einfache PDF-Textleseaufgaben. Diese Methode behandelt Leerzeichen und Kodierungsunterschiede innerhalb von PDF-Quelldokumenten ohne Probleme.

PdfDocument.ExtractTextFromPage liest den Text von bestimmten Seiten eines PDFs. Im folgenden Beispiel sehen wir es, wie es iterativ verwendet wird, um Textinhalte aus einem bestimmten Seitenbereich abzurufen.

IronPDF kann auch Rohbilder aus PDFs extrahieren. Verwenden Sie dafür eine der untenstehenden Methoden der PdfDocument-Klasse:

  • ExtractAllImages: Gibt alle in einem PDF eingebetteten Bilder als IronSoftware.Drawing.AnyBitmap Objekte zurück.
  • ExtractAllRawImages: Ruft alle eingebetteten Bilder als Liste von roh Bytes (byte[]) ab.
  • ExtractImagesFromPage: Extrahiert die Bilder, die auf einer indizierten Seite enthalten sind.
  • ExtractImagesFromPages: Genauso wie ExtractImagesFromPage, aber von einem bestimmten Seitenbereich oder von einer Liste einzelner Seiten.
  • ExtractRawImagesFromPage und ExtractRawImagesFromPages: funktioniert genauso wie die beiden vorhergehenden Methoden, gibt jedoch die extrahierten Bilder als Byte-Arrays anstelle von IronSoftware.Drawing.AnyBitmap Objekten zurück.

Learn more about ExtractTextFromPage Method

Bereit anzufangen?
Nuget Downloads 20,296,129 | Version: 2026.7 gerade veröffentlicht
Still Scrolling Icon

Scrollst du immer noch?

Sie brauchen schnell einen Beweis? PM > Install-Package IronPdf
Führen Sie eine Probe aus Sehen Sie zu, wie Ihr HTML-Code in eine PDF-Datei umgewandelt wird.