
Wie man ein Passwort aus einer PDF-Datei entfernt
Ihr Unternehmen gibt zu viel für jährliche Abonnements für PDF-Sicherheit und -Compliance aus. Erwägen Sie IronSecureDoc, das Lösungen für die Verwaltung von SaaS-Diensten wie digitale Signierung, Schwärzung, Verschlüsselung und Schutz bietet, alles zu einer einmaligen Zahlung. Erfahren Sie mehr über IronSecureDoc
Das Extrahieren von Daten aus PDFs ist entscheidend, um Zeit bei der manuellen Eingabe zu sparen. Dieser Artikel erklärt, wie Entwickler die IronPDF-Bibliothek verwenden können, um Text und Bilder aus PDF-Dokumenten zu extrahieren.
Wie man Daten aus PDF in C# extrahiert
- Herunterladen von Extract Data from PDF C# library
- Ein neues Projekt in Visual Studio erstellen
- Bibliothek zu Ihrem Projekt installieren
- Extrahieren von Daten aus bestimmten Seiten und Extrahieren bestimmter Daten aus PDF
- Datenoutput aus PDF-Dokument anzeigen
IronPDF: C# PDF-Bibliothek
IronPDF ist eine .NET-Bibliothek, die zum Erstellen, Bearbeiten und Konvertieren von PDF-Dateien verwendet werden kann. Sie bietet eine benutzerfreundliche API für Entwickler, die in ihren Anwendungen verwendet werden kann. Sie ist weltweit eine der beliebtesten Bibliotheken zum Erstellen, Bearbeiten und Konvertieren von PDF-Dateien. Mit IronPDF können Sie eine einfache und schnelle Lösung für PDFs erstellen. Ihr Text wird für jedes Dokument angepasst, Ihr Layout wird für ein leichtes Lesen eingerichtet und Ihre Grafiken werden mit Hilfe des begleitenden .NET-Programms gestaltet.
Die IronPDF-Bibliothek verfügt über eine fantastische Funktion zum Extrahieren von Daten aus PDF-Dateien. Dieser Artikel wird sich damit befassen, wie man Daten mit IronPDF extrahieren kann. Zuerst muss ein C#-Projekt erstellt oder geöffnet werden. Kommen wir zum nächsten Abschnitt.
Erstellen oder Öffnen eines C#-Projekts in Visual Studio
Dieses Tutorial empfiehlt die Verwendung der neuesten Version von Visual Studio.
Sobald Visual Studio geöffnet ist, befolgen Sie die unten stehenden Schritte, um ein neues C#-Projekt zu erstellen. Wenn ein bestehendes Projekt verwendet werden soll, dann überspringen Sie diese nächsten Schritte und fahren direkt mit dem nächsten Abschnitt fort.
- Öffnen Sie Visual Studio
- Klicken Sie auf die Schaltfläche "Ein neues Projekt erstellen".
Visual Studio Benutzeroberfläche öffnen
- Wählen Sie die "C# Console Application" aus den Vorlagen.
Ein neues Projekt erstellen
- Geben Sie dem Projekt einen Namen und klicken Sie auf die Schaltfläche Next.
- Wählen Sie ein .NET-Framework entsprechend den Anforderungen Ihres Projekts aus und klicken Sie auf die Schaltfläche Create.
.NET Framework-Auswahl
Visual Studio wird jetzt ein neues C# .NET-Projekt generieren.
Die IronPDF-Bibliothek installieren
Die IronPDF-Bibliothek kann auf unterschiedliche Weise installiert werden.
Verwendung der Paket-Manager-Konsole
- Öffnen Sie die Paket-Manager-Konsole, indem Sie zu Tools > NuGet Package Manager > Package Manager Console gehen.
- Führen Sie den folgenden Befehl aus, um die IronPDF-Bibliothek zu installieren:
Installationsfortschritt im Package Manager Console-Tab
Nach der Installation sehen Sie die IronPDF-Abhängigkeit im dependencies Abschnitt des Projektmappen-Explorers, wie unten gezeigt.
IronPDF-Paket im Solution Explorer referenzieren
Verwendung des NuGet Package Managers
Eine andere Möglichkeit, die IronPDF-Bibliothek zu installieren, ist die Verwendung der integrierten NuGet Package Manager-UI von Visual Studio.
- Gehen Sie zu den Tools im Hauptmenü. Fahren Sie im Dropdown-Menü mit der Maus über "NuGet Package Manager" und wählen Sie "Manage NuGet Packages for Solution...".
Zu NuGet Package Manager navigieren
- Dadurch wird das Fenster des NuGet-Paket-Managers geöffnet. Gehen Sie zum Durchsuchen-Tab, schreiben Sie
IronPdfin die Suche und drücken Sie Enter. - Wählen Sie IronPDF aus den Suchergebnissen aus und klicken Sie auf die "Install"-Schaltfläche, um die Installation zu starten.
Installieren Sie das IronPDF-Paket über den NuGet-Paketmanager
Daten aus PDF-Dateien extrahieren
Werfen wir einen Blick auf den folgenden Code, der zeigt, wie man mit IronPDF Daten extrahiert:
// Import necessary namespaces
using IronPdf;
using System.Collections.Generic;
using System.Drawing;
public class PDFExtractor
{
public void ExtractDataFromPDF()
{
// Open a 128-bit encrypted PDF file by providing the filename and password
using PdfDocument pdf = PdfDocument.FromFile("encrypted.pdf", "password");
// Extract all text from the PDF document
string allText = pdf.ExtractAllText();
// Extract all images from the PDF document
IEnumerable<Image> allImages = pdf.ExtractAllImages();
// Iterate over each page in the PDF document
for (var index = 0; index < pdf.PageCount; index++)
{
int pageNumber = index + 1;
// Extract text from the specific page
string text = pdf.ExtractTextFromPage(index);
// Extract images from the specific page
IEnumerable<Image> images = pdf.ExtractImagesFromPage(index);
// Code to process the extracted text and images
//...
}
}
}' Import necessary namespaces
Imports IronPdf
Imports System.Collections.Generic
Imports System.Drawing
Public Class PDFExtractor
Public Sub ExtractDataFromPDF()
' Open a 128-bit encrypted PDF file by providing the filename and password
Using pdf As PdfDocument = PdfDocument.FromFile("encrypted.pdf", "password")
' Extract all text from the PDF document
Dim allText As String = pdf.ExtractAllText()
' Extract all images from the PDF document
Dim allImages As IEnumerable(Of Image) = pdf.ExtractAllImages()
' Iterate over each page in the PDF document
For index = 0 To pdf.PageCount - 1
Dim pageNumber As Integer = index + 1
' Extract text from the specific page
Dim text As String = pdf.ExtractTextFromPage(index)
' Extract images from the specific page
Dim images As IEnumerable(Of Image) = pdf.ExtractImagesFromPage(index)
' Code to process the extracted text and images
'...
Next index
End Using
End Sub
End ClassIn diesem Codebeispiel:
- Die Methode
FromFilewird verwendet, um das Eingabe-PDF-Dokument zu laden, das verschlüsselt ist und ein Passwort erfordert. - Die Methode
ExtractAllTextextrahiert alle textuellen Inhalte aus dem PDF. - Die Methode
ExtractAllImagesruft alle eingebetteten Bilder ab. - Eine Schleife iteriert über jede Seite des Dokuments, um Text und Bilder von dieser bestimmten Seite mithilfe von
ExtractTextFromPageundExtractImagesFromPagezu extrahieren.
Abschluss
IronPDF ermöglicht es Entwicklern, mit Leichtigkeit Text und Bilder aus PDF-Dateien zu extrahieren. Mit ExtractAllText und ExtractAllImages können die gesamten Inhalte einer PDF-Datei sofort extrahiert werden. Alternativ können diese Methoden auch verwendet werden, um Inhalte von spezifischen Seiten zu extrahieren. Der vorhergehende Code zeigte, wie man beide Methoden verwendet, um Text und Bilder von einer Reihe von Seiten zu lesen.
Zusätzlich bietet IronPDF Funktionen wie Diagrammerstellung, Hinzufügen von Barcodes, Sicherheitsverbesserungen mit Passwörtern, Wasserzeichen und die Verwaltung von PDF-Formularen programmatisch.
IronPDF ist während der Entwicklung kostenlos verfügbar, bei kommerzieller Nutzung ist eine Zahlung erforderlich. Ein kostenloser Test von IronPDF ist für die Produktion ohne Zahlung verfügbar.
Kaufen Sie das [vollständige Angebot der Dokumentbibliotheken von Iron Software](Iron Suite) zum Preis von zwei IronPDF Lite-Lizenzen.
Laden Sie IronPDF jetzt herunter, um heute noch mit dem Extrahieren von Daten aus PDFs zu beginnen!

Curtis Chau hat einen Bachelor-Abschluss in Informatik von der Carleton University und ist spezialisiert auf Frontend-Entwicklung mit Expertise in Node.js, TypeScript, JavaScript und React. Leidenschaftlich widmet er sich der Erstellung intuitiver und ästhetisch ansprechender Benutzerschnittstellen und arbeitet gerne mit modernen Frameworks sowie der Erstellung gut strukturierter, optisch ansprechender Handbücher.
Verwandte Artikel


