IRONSOFTWAREHOME
Odczytywanie plików PDF w języku C#
using IronPdf;
using IronSoftware.Drawing;
using System.Collections.Generic;

// Extracting Image and Text content from Pdf Documents

// open a 128 bit encrypted PDF
var pdf = PdfDocument.FromFile("encrypted.pdf", "password");

// Get all text to put in a search index
string text = pdf.ExtractAllText();

// Get all Images
var allImages = pdf.ExtractAllImages();

// Or even find the precise text and images for each page in the document
for (var index = 0 ; index < pdf.PageCount ; index++)
{
    int pageNumber = index + 1;
    text = pdf.ExtractTextFromPage(index);
    List<AnyBitmap> images = pdf.ExtractBitmapsFromPage(index);
    //...
}
Imports IronPdf
Imports IronSoftware.Drawing
Imports System.Collections.Generic

' Extracting Image and Text content from Pdf Documents

' open a 128 bit encrypted PDF
Dim pdf = PdfDocument.FromFile("encrypted.pdf", "password")

' Get all text to put in a search index
Dim text As String = pdf.ExtractAllText()

' Get all Images
Dim allImages = pdf.ExtractAllImages()

' Or even find the precise text and images for each page in the document
For index As Integer = 0 To pdf.PageCount - 1
    Dim pageNumber As Integer = index + 1
    text = pdf.ExtractTextFromPage(index)
    Dim images As List(Of AnyBitmap) = pdf.ExtractBitmapsFromPage(index)
    '...
Next
NuGet Download
Install-Package IronPdf
Odczytywanie plików PDF w języku C#

Odczytywanie plików PDF w języku C#

Metoda PdfDocument.ExtractAllText z biblioteki PDF IronPDF C# jest idealna do prostych zadań związanych z odczytem tekstu PDF. Metoda ta bez problemu radzi sobie z rozbieżnościami w zakresie spacji i kodowania w źródłowych dokumentach PDF.

PdfDocument.ExtractTextFromPage odczytuje tekst z określonych stron PDF. W poniższym przykładzie widzimy, jak jest on używany iteracyjnie do pobierania treści tekstowych z określonego zakresu stron.

IronPDF może również wyodrębniać surowe obrazy z plików PDF. Do tego użyj dowolnej metody z klasy PdfDocument poniżej:

  • ExtractAllImages: zwraca wszystkie osadzone obrazy PDF jako obiekty IronSoftware.Drawing.AnyBitmap.
  • ExtractAllRawImages: odzyskuje wszystkie osadzone obrazy jako listę surowych bajtów (byte[]).
  • ExtractImagesFromPage: wyciąga obrazy zawarte na indeksowanej stronie.
  • ExtractImagesFromPages: to samo co ExtractImagesFromPage, ale z określonego zakresu stron lub listy poszczególnych stron.
  • ExtractRawImagesFromPage i ExtractRawImagesFromPages: działa tak samo jak poprzednie dwie metody, ale zwraca wyodrębnione obrazy jako tablice bajtów zamiast obiektów IronSoftware.Drawing.AnyBitmap.

Learn more about ExtractTextFromPage Method
Zobacz na GitHubie

Gotowy, aby rozpocząć?

Nuget Downloads 20,667,543Wersja:2026.7właśnie wydany

Key in blue circle

Uzyskaj natychmiast swój darmowy 30-dniowy Klucz Testowy.

Brak ograniczeń. 100% dostępności. Bez karty kredytowej.

bullet_checkedNie wymaga karty kredytowej ani tworzenia kontaBrak ograniczeń. 100% dostępności. Bez karty kredytowej.
  • Logo Aetna
  • Logo NASA
  • Logo GE
  • Logo Porsche
  • Logo USDA
  • Logo Qatar
Join Millions of Engineers who’ve tried IronPDF
Zarezerwuj swoje darmowe Demo na żywo
Booking Badge

Zaufane przez miliony inżynierów na całym świecie

Logotypy klientów Iron Software
Otrzymaj swoje Konsultacja Bez Zobowiązań
Wypełnij poniższy formularz lub wyślij e-mail na sales@ironsoftware.com
Twoje dane zawsze będą utrzymywane w tajemnicy.
Zaufane przez miliony inżynierów na całym świecie
Logotypy klientów Iron Software
Otrzymaj swój darmowy Klucz Próbny na 30 dni natychmiast.
Nie wymaga karty kredytowej ani tworzenia konta