Lire les fichiers PDF en C#
La méthode PdfDocument.ExtractAllText de la bibliothèque PDF IronPDF en C# est parfaite pour les tâches de lecture de texte PDF pur. Cette méthode gère les écarts d'espacement et de codage dans les documents PDF source sans aucun problème.
PdfDocument.ExtractTextFromPage lit le texte des pages spécifiques d'un PDF. Dans l'exemple ci-dessous, nous le voyons utilisé de manière itérative pour récupérer le contenu textuel d'une plage spécifique de pages.
IronPDF peut également extraire des images brutes à partir de PDFs. Pour cela, utilisez l'une des méthodes de la classe PdfDocument ci-dessous :
ExtractAllImages: retourne toutes les images intégrées dans un PDF comme objetsIronSoftware.Drawing.AnyBitmap.ExtractAllRawImages: récupère toutes les images intégrées sous forme de liste de bytes bruts (byte[]).ExtractImagesFromPage: extrait les images contenues sur une page indexée.ExtractImagesFromPages: commeExtractImagesFromPage, mais à partir d'une plage de pages spécifique ou d'une liste de pages individuelles.ExtractRawImagesFromPageetExtractRawImagesFromPages: fonctionne de la même manière que les deux méthodes précédentes, mais retourne les images extraites sous forme de tableaux de bytes plutôt que d'objetsIronSoftware.Drawing.AnyBitmap.
Comment lire les fichiers PDF en C#
- Télécharger la bibliothèque IronPDF pour C#
- Extraire des images ou du texte d'un PDF
- Lire et trouver des mots dans des documents spécifiques
- Afficher la sortie PDF de votre document original

