
Jak usunąć hasło z pliku PDF
Twoje przedsiebiorstwo wydaje zbyt duzo na roczne subskrypcje dla zabezpieczen PDF i zgodnosci. Rozwaz IronSecureDoc, ktory oferuje rozwiazania do zarzadzania uslugami SaaS, jak podpis cyfrowy, redakcja, szyfrowanie i ochrona, wszystko za jednorazowa platnosc. Dowiedz się wiecej o IronSecureDoc
Pobieranie danych z plików PDF ma kluczowe znaczenie dla oszczędności czasu związanego z ręcznym wprowadzaniem danych. W tym artykułe wyjaśniono, w jaki sposób programiści mogą wykorzystać bibliotekę IronPDF do wyodrębniania tekstu i obrazów z dokumentów PDF.
Jak wyodrębnić dane z pliku PDF w języku C#
- Pobierz bibliotekę Extract Data from PDF C#
- Utwórz nowy projekt w Visual Studio
- Zainstaluj bibliotekę w swoim projekcie
- Wyodrębnij dane z określonych stron i wyodrębnij konkretne elementy z pliku PDF
- Wyświetl dane wyjściowe z dokumentu PDF
IronPDF: biblioteka PDF dla języka C#
IronPDF to biblioteka .NET, która może służyć do tworzenia, edycji i konwersji plików PDF. Zapewnia łatwy w użyciu interfejs API, z którego programiści mogą korzystać w swoich aplikacjach. Jest to jedna z najpopularniejszych bibliotek do tworzenia, edycji i konwersji plików PDF na całym świecie. Dzięki IronPDF możesz stworzyć proste i szybkie rozwiązanie do obsługi plików PDF. Tekst zostanie dostosowany do każdego dokumentu, układ zostanie skonfigurowany tak, aby ułatwić czytanie, a grafika zostanie zaprojektowana przy pomocy dołączonego programu .NET.
Biblioteka IronPDF posiada fantastyczną funkcję do wyodrębniania danych z plików PDF. W tym artykułe przyjrzymy się, jak wyodrębniać dane za pomocą IronPDF. Najpierw należy utworzyć lub otworzyć projekt C#. Przejdźmy do następnej sekcji.
Utworz lub Otworz projekt C# w Visual Studio
W tym samouczku zaleca się korzystanie z najnowszej wersji programu Visual Studio.
Po uruchomieniu programu Visual Studio wykonaj poniższe czynności, aby utworzyć nowy projekt w języku C#. Jeśli masz już gotowy projekt, z którego chcesz skorzystać, pomiń poniższe kroki i przejdź bezpośrednio do następnej sekcji.
- Otwórz Visual Studio
- Kliknij przycisk "Utwórz nowy projekt".
Interfejs użytkownika programu Visual Studio
- Wybierz "Aplikacja konsolowa C#" z szablonów.
Utwórz nowy projekt
- Nadaj nazwę projektowi i kliknij przycisk Dalej.
- Wybierz .NET Framework zgodnie z wymaganiami projektu i kliknij przycisk Utwórz.
Wybór platformy .NET Framework
Visual Studio wygeneruje teraz nowy projekt C# .NET.
Zainstaluj bibliotekę IronPDF
Bibliotekę IronPDF można zainstalować na wiele sposobów.
Korzystanie z konsoli menedżera pakietów
- Otwórz konsolę menedżera pakietów, przechodząc do menu Narzędzia > Menedżer pakietów NuGet > Konsola menedżera pakietów.
- Uruchom następujące polecenie, aby zainstalować bibliotekę IronPDF:
Postęp instalacji w zakładce Konsola menedżera pakietów
Po instalacji zobaczysz zależność IronPDF w sekcji dependencies w Eksploratorze Rozwiązań, jak pokazano poniżej.
Odnosnik do pakietu IronPDF w Eksploratorze Rozwiazania
Korzystanie z menedżera pakietów NuGet
Innym sposobem instalacji biblioteki IronPDF jest użycie zintegrowanego interfejsu użytkownika menedżera pakietów NuGet w Visual Studio.
- Przejdź do sekcji Narzędzia w menu głównym. Najedź kursorem na "NuGet Package Manager" w menu rozwijanym i wybierz opcję "Manage NuGet Packages for Solution...".
Przejdź do menedżera pakietów NuGet
- Spowoduje to otwarcie okna Menedżera pakietów NuGet. Przejdź do zakładki Przeglądaj, wpisz
IronPdfw wyszukiwarce i naciśnij Enter. - Wybierz IronPDF z wyników wyszukiwania i kliknij przycisk "Zainstaluj", aby rozpocząć instalację.
Zainstaluj pakiet IronPDF z Menedżera pakietów NuGet
Pobieranie danych z plików PDF
Przyjrzyjmy się poniższemu kodowi pokazującemu, jak wyodrębnić dane za pomocą IronPDF:
// Import necessary namespaces
using IronPdf;
using System.Collections.Generic;
using System.Drawing;
public class PDFExtractor
{
public void ExtractDataFromPDF()
{
// Open a 128-bit encrypted PDF file by providing the filename and password
using PdfDocument pdf = PdfDocument.FromFile("encrypted.pdf", "password");
// Extract all text from the PDF document
string allText = pdf.ExtractAllText();
// Extract all images from the PDF document
IEnumerable<Image> allImages = pdf.ExtractAllImages();
// Iterate over each page in the PDF document
for (var index = 0; index < pdf.PageCount; index++)
{
int pageNumber = index + 1;
// Extract text from the specific page
string text = pdf.ExtractTextFromPage(index);
// Extract images from the specific page
IEnumerable<Image> images = pdf.ExtractImagesFromPage(index);
// Code to process the extracted text and images
//...
}
}
}' Import necessary namespaces
Imports IronPdf
Imports System.Collections.Generic
Imports System.Drawing
Public Class PDFExtractor
Public Sub ExtractDataFromPDF()
' Open a 128-bit encrypted PDF file by providing the filename and password
Using pdf As PdfDocument = PdfDocument.FromFile("encrypted.pdf", "password")
' Extract all text from the PDF document
Dim allText As String = pdf.ExtractAllText()
' Extract all images from the PDF document
Dim allImages As IEnumerable(Of Image) = pdf.ExtractAllImages()
' Iterate over each page in the PDF document
For index = 0 To pdf.PageCount - 1
Dim pageNumber As Integer = index + 1
' Extract text from the specific page
Dim text As String = pdf.ExtractTextFromPage(index)
' Extract images from the specific page
Dim images As IEnumerable(Of Image) = pdf.ExtractImagesFromPage(index)
' Code to process the extracted text and images
'...
Next index
End Using
End Sub
End ClassW tym przykładzie kodu:
- Metoda
FromFilesłuży do załadowania dokumentu PDF, który jest zaszyfrowany i wymaga hasła. - Metoda
ExtractAllTextwyodrębnia całą treść tekstową z PDF. - Metoda
ExtractAllImagespobiera wszystkie osadzone obrazy. - Pętla przechodzi przez każdą stronę dokumentu, aby wydobyć tekst i obrazy z tej konkretnej strony za pomocą
ExtractTextFromPageiExtractImagesFromPage.
Wnioski
IronPDF pozwala programistom z łatwością wyodrębniać tekst i obrazy z plików PDF. Używając ExtractAllText i ExtractAllImages, można natychmiast wydobyć całą zawartość pliku PDF. Alternatywnie, metody te można wykorzystać do wyodrębnienia treści z konkretnej strony. Poprzedni kod pokazał, jak używać obu metod do odczytywania tekstu i obrazów z szeregu stron.
Ponadto IronPDF oferuje funkcje takie jak renderowanie wykresów, dodawanie BarCode'ów, zwiększanie bezpieczeństwa za pomocą haseł, znakowanie wodne oraz programowe przetwarzanie formularzy PDF.
IronPDF jest dostępny bezpłatnie na etapie rozwoju, natomiast za użytkowanie komercyjne wymagana jest opłata. Dostępna jest bezpłatna wersja próbna IronPDF do użytku produkcyjnego bez konieczności dokonywania płatności.
Kup pełny pakiet bibliotek dokumentów Iron Software za cenę dwóch licencji IronPDF Lite.
Pobierz IronPDF już teraz, aby jeszcze dziś rozpocząć wyodrębnianie danych z plików PDF!

Curtis Chau posiada tytuł licencjata z informatyki (Uniwersytet Carleton) i specjalizuje się w front-endowym rozwoju, z ekspertką w Node.js, TypeScript, JavaScript i React. Pasjonuje się tworzeniem intuicyjnych i estetycznie przyjemnych interfejsów użytkownika, Curtis cieszy się pracą z nowoczesnymi frameworkami i tworzeniem dobrze zorganizowanych, atrakcyjnych wizualnie podręczników.
Powiązane artykuły


