
Wie man PDF in .NET MAUI anzeigt (Schritt-für-Schritt) Tutorial
Dieses Tutorial führt ein, wie man programmgesteuert Texte und Bilder aus PDF-Dateien mit erstklassiger Unterstützung von IronPDF extrahiert.
Wie man eine PDF-Datei in VB.NET parst
- Herunterladen der IronPDF C#-Bibliothek zum Parsen von PDF-Dateien
- Verwendung der
FromFile-Methode zum Parsen von PDF-Dateien in VB.NET - Extrahieren von Text aus geöffneten PDF-Dateien mit der Methode
ExtractAllText - Verwenden Sie die Methode
ExtractTextFromPages, um Text aus bestimmten Seiten zu extrahieren - Extrahieren von Bildern aus geöffneten PDF-Dateien mit der Methode
ExtractRawImagesFromPage
IronPDF
Funktionen
Effiziente PDF-Konvertierung. Fast alles, was eine Maschine tun kann, kann IronPDF auch. Dank dieser PDF-Bibliothek können Entwickler schnell erstellen, Textinhalte lesen, schreiben, laden und PDF manipulieren.
IronPDF konvertiert HTML in ein PDF-Dokument mithilfe der Chrome-Engine. Zusammen mit Windows Forms, HTML, ASPX, Razor HTML, .NET Core, ASP.NET, Windows Forms und WPF. IronPDF unterstützt auch Xamarin-, Blazor-, Unity- und HoloLens-Anwendungen. IronPDF unterstützt sowohl Microsoft .NET als auch .NET Core-Anwendungen (sowohl ASP.NET-Webpakete als auch herkömmliche Windows-Pakete). IronPDF kann verwendet werden, um ästhetisch ansprechende PDFs zu erstellen.
IronPDF kann ein PDF mit HTML5, JavaScript, CSS und Bildern erstellen. IronPDF hat auch einen leistungsstarken HTML-zu-PDF-Konverter, der sich in PDF integriert. Ein starkes PDF-Konvertierungssystem ist in IronPDF vorhanden, das die Chromium-Renderengine verwendet. Es ist auch unabhängig von externen Quellen.
- Ein PDF-Bild kann aus verschiedenen Quellen erstellt werden, einschließlich HTML, HTML5, ASPX und Razor/MVC-Ansicht. Sowohl HTML- als auch Bilddateien können in PDF konvertiert werden.
- Werkzeuge, die zur Arbeit mit interaktiven PDFs verwendet werden können, beinhalten das Ausfüllen und Absenden interaktiver Formulare.
- Zusammenführen und Teilen von PDFs, Text und Bilder aus PDF-Dateien extrahieren, Text in PDF-Dateien suchen, PDFs in Bilder umwandeln, Schriftgröße ändern und PDF-Dateien konvertieren.
- Es ermöglicht die Verifizierung von HTML-Login-Formularen mithilfe von User-Agents, Proxies, Cookies, HTTP-Headern und Formularvariablen.
- Der Zugriff auf gesicherte Dokumente wird durch IronPDF ermöglicht, indem Benutzernamen und Passwörter bereitgestellt werden.
- IronPDF ist ein Programm, das Text in PDF liest und die Lücken füllt.
- Ermöglicht das Hinzufügen von Text, Bildern, Lesezeichen, Wasserzeichen und mehr.
- Sie können eine PDF-Datei aus einer CSS-Datei erstellen.
Für weitere Details besuchen Sie bitte diese IronPDF-Lizenzierungsinformationsseite für einen kostenlosen limitierten Schlüssel und die professionelle Version.
IronPDF- Schriftformatierung
Text aus der PDF-Datei extrahieren
IronPDF kann mit Hilfe der IronPDF-Bibliotheken auch Text aus PDF-Dateien lesen und extrahieren. Nachfolgend ein Beispielcode von IronPDF, der zum Untersuchen vorhandener PDF-Dateien verwendet werden kann.
Text von allen Seiten extrahieren
Das nachstehende Codebeispiel zeigt die erste Methode, um den gesamten PDF-Inhalt als String mit nur wenigen Zeilen zu erhalten.
Imports IronPdf
Module Program
Sub Main(args As String())
' Create a PDF Document object from an existing PDF file
Dim pdfdoc = PdfDocument.FromFile("result.pdf")
' Extract all the text from the PDF
Dim AllText As String = pdfdoc.ExtractAllText()
' Output the extracted text to the console
Console.WriteLine(AllText)
End Sub
End Module
Der obige Beispielcode zeigt, wie die FromFile Methode verwendet wird, um ein PDF aus einer bestehenden Datei zu lesen und es in ein PDF-Dokument-Objekt zu konvertieren. Das Objekt stellt eine Methode namens ExtractAllText bereit, die den einfachen Text aus dem PDF extrahiert und in eine Zeichenkette umwandelt.
Text nach Seitenzahl extrahieren
Der unten stehende Beispielcode zeigt, wie man Daten aus einer PDF-Datei mit der Seitenzahl extrahiert.
Imports IronPdf
Module Program
Sub Main(args As String())
' Create a PDF Document object from an existing PDF file
Dim pdfdoc = PdfDocument.FromFile("result.pdf")
' Extract text from the first page (page numbers are zero-based)
Dim AllText As String = pdfdoc.ExtractTextFromPage(0)
' Output the extracted text to the console
Console.WriteLine(AllText)
End Sub
End Module
Der obige Code zeigt, wie man ein PDF aus einer bestehenden Datei liest und es mithilfe der FromFile Funktion in ein PDF-Dokument-Objekt umwandelt. Texte und Bilder können mit diesem Objekt im PDF aufgerufen werden. Das Objekt bietet eine Methode namens ExtractTextFromPage, die es Ihnen ermöglicht, eine Seitennummer als Parameter zu übergeben, um eine Zeichenkette zu erhalten, die jedes Wort enthält, das auf dieser Seite des PDFs stand.
Text zwischen Seiten extrahieren
Der unten stehende Code zeigt, wie man die Daten zwischen mehreren Seiten extrahiert.
Imports IronPdf
Module Program
Sub Main(args As String())
' Define a list of page numbers from which to extract text
Dim Pages As List(Of Integer) = New List(Of Integer) From {3, 5, 7}
' Create a PDF Document object from an existing PDF file
Dim pdfdoc = PdfDocument.FromFile("result.pdf")
' Extract text from the specified pages
Dim AllText As String = pdfdoc.ExtractTextFromPages(Pages)
' Output the extracted text to the console
Console.WriteLine(AllText)
End Sub
End Module
Der obige Code demonstriert, wie die FromFile Methode verwendet wird, um ein PDF aus einer bestehenden Datei zu lesen und es in ein PDF-Dokument-Objekt zu konvertieren. Dieses Objekt ermöglicht das Untersuchen der Texte und Bilder im PDF. Das Objekt hat eine Methode namens ExtractTextFromPages, die verwendet werden kann, um eine Zeichenkette zu erhalten, die alle Textinhalte auf bestimmten Seiten des Dokuments enthält, indem eine Liste von Seitennummern als Parameter übergeben wird. Unten links ist das Ausgangs-PDF und rechts sind die extrahierten Daten.
Extrahierter Text zwischen Seiten
Bilder aus der PDF-Datei extrahieren
IronPDF bietet eine Liste von Methoden, um Bilder zu extrahieren, wie zum Beispiel:
ExtractBitmapsFromPageExtractBitmapsFromPagesExtractImagesFromPageExtractImagesFromPagesExtractRawImagesFromPageExtractRawImagesFromPages
Jede Methode ermöglicht das Extrahieren von Bildern von einer Seite oder mehreren Seiten des Dokuments.
Imports IronPdf
Imports System.Drawing
Module Program
Sub Main(args As String())
' Create a PDF Document object from an existing PDF file
Dim pdfdoc = PdfDocument.FromFile("result.pdf")
' Extract raw images from the first page
Dim images = pdfdoc.ExtractRawImagesFromPage(1)
' Iterate over extracted images
For Each imgData As Byte() In images
' Create a memory stream from byte data
Using ms As New IO.MemoryStream(imgData)
' Create a Bitmap object from the memory stream
Dim image = New Bitmap(ms)
' Save the image to the specified output directory
image.Save("output/test.jpg")
End Using
Next
End Sub
End Module
Der obige Code zeigt, wie man ein Dokument aus einer bestehenden Datei liest und es mithilfe der FromFile Funktion in ein PDF-Dokument-Objekt umwandelt. Durch die Übergabe einer Seitennummer an die ExtractRawImagesFromPage Methode des Objekts kann eine Liste von Bytes erhalten werden, die jedes Bild enthält, das auf dieser Seite des Dokuments vorhanden war. Durch die Verwendung einer For Each Schleife wird jeder Bytestrom verarbeitet und in einen Speicherstrom und dann in ein Bitmap umgewandelt, was beim Speichern der Bilder hilft. Das unten stehende Bild zeigt die Ausgabe des obigen Codes.
Ausbilderbilder aus PDF
Um mehr über das IronPDF-API-Codetutorial zu erfahren, beziehen Sie sich auf die IronPDF-Dokumentation. Sie können auch andere Tutorials besuchen, um zu erfahren, wie Sie PDF-Text mit C# analysieren.
Abschluss
Die Entwicklungslizenz für die IronPDF-Bibliothek ist kostenlos. Beim Einsatz von IronPDF in einer Produktionsumgebung können je nach den Anforderungen des Entwicklers unterschiedliche Lizenzen erworben werden. Der Lite-Plan beginnt bei $999 und hat keine laufenden Kosten. SaaS- und OEM-Umvertrieb-Alternativen werden ebenfalls angeboten. Alle Lizenzen umfassen Updates, ein Jahr Produktsupport und eine permanente Lizenz. Sie sind auch nützlich für Herstellung, Staging und Entwicklung. Es ist ein einmaliger Kauf. Es gibt zusätzliche kostenlose, zeitlich begrenzte Lizenzen, die zugänglich sind. Besuchen Sie die umfassenden IronPDF-Lizenzierungsinformationen, um die vollständigen Preis- und Lizenzierungsdetails für IronPDF zu lesen. IronPDF bietet auch kostenlose Lizenzen für Kopierschutz.

Curtis Chau hat einen Bachelor-Abschluss in Informatik von der Carleton University und ist spezialisiert auf Frontend-Entwicklung mit Expertise in Node.js, TypeScript, JavaScript und React. Leidenschaftlich widmet er sich der Erstellung intuitiver und ästhetisch ansprechender Benutzerschnittstellen und arbeitet gerne mit modernen Frameworks sowie der Erstellung gut strukturierter, optisch ansprechender Handbücher.
Verwandte Artikel


