Altbilgi içeriğine atla
IRONPDF KULLANARAK
IronPDF ve C# kullanarak PDF Dosyalarından Metin Nasıl Çıkartılır

IronPDF Kullanarak C#'da PDF'ler Oluşturma

PDF'lerden veri çıkarmak, manuel girişi azaltarak zaman kazandırmak için çok önemlidir. Bu makale, geliştiricilerin IronPDF kütüphanesini kullanarak metin ve görüntüleri nasıl çıkaracaklarını açıklar.

IronPDF: C# PDF Kütüphanesi

IronPDF, PDF dosyalarını oluşturmak, düzenlemek ve dönüştürmek için kullanılabilen bir .NET kütüphanesidir. Geliştiricilerin kendi uygulamalarında kullanabileceği kolay bir API sunar. Dünya çapında PDF dosyalarını oluşturmak, düzenlemek ve dönüştürmek için en popüler kütüphanelerden biridir. IronPDF ile PDF'ler için kolay ve hızlı bir çözüm üretebilirsiniz. Metniniz belgeler için özelleştirilecek, düzeniniz kolay okunabilmesi için ayarlanacak ve grafikleriniz, eşlik eden .NET programının yardımıyla tasarlanacaktır.

IronPDF kütüphanesinin PDF dosyalarından veri çekme konusunda harika bir özelliği vardır. Bu makalede IronPDF kullanarak verilerin nasıl çıkarılacağına bakacağız. Öncelikle bir C# Projesi oluşturulmalı veya açılmalıdır. Sonraki bölüme geçelim.

Visual Studio'da bir C# Projesi Oluşturun veya Açın

Bu öğretici, Visual Studio'nun en son sürümünün kullanılmasını önerir.

Visual Studio açıldığında, yeni bir C# Projesi oluşturmak için aşağıdaki adımları izleyin. Kullanmak istediğiniz mevcut bir proje varsa, bu adımları atlayın ve doğrudan bir sonraki bölüme geçin.

  • Visual Studio'yu açın
  • 'Yeni bir proje oluştur' butonuna tıklayın.

C# ile PDF'lerden Veri Çıkartma, Şekil 1: Visual Studio açılış arayüzü Visual Studio açılış arayüzü

  • Şablonlardan "C# Console Application" seçin.

C# ile PDF'lerden Veri Çıkartma, Şekil 2: Yeni bir proje oluştur Yeni bir proje oluşturun

  • Projeye bir ad verin ve Next düğmesine tıklayın.
  • Projenizin gereksinimlerine göre bir .NET Framework seçin ve Create butonuna tıklayın.

C# ile PDF'lerden Veri Çıkartma, Şekil 3: .NET Framework seçimi .NET Framework seçimi

Visual Studio şimdi yeni bir C# .NET projesi oluşturacak.

IronPDF Kütüphanesini Yükleme

IronPDF kütüphanesi birden fazla şekilde yüklenebilir.

Paket Yöneticisi Konsolunu Kullanarak

  • Tools > NuGet Package Manager > Package Manager Console menüsüne giderek Paket Yöneticisi Konsolunu açın.
  • IronPDF kütüphanesini yüklemek için aşağıdaki komutu çalıştırın:
Install-Package IronPdf

C# ile PDF'lerden Veri Çıkartma, Şekil 4: Paket Yöneticisi Konsolu sekmesinde kurulum ilerlemesi Paket Yöneticisi Konsolundaki yükleme ilerlemesi

Kurulumdan sonra, aşağıda gösterildiği gibi Çözüm Gezgini'nin dependencies bölümünde IronPDF bağımlılığını göreceksiniz.

C# ile PDF'lerden Veri Çıkartma, Şekil 5: Çözüm Gezgini'nde IronPDF paketine referans ver Solution Explorer'da IronPDF paketine referans verin

NuGet Paket Yöneticisini Kullanma

IronPDF kütüphanesini yüklemenin başka bir yolu, Visual Studio'nun entegre NuGet Paket Yöneticisi arayüzünü kullanmaktır.

  • Ana menüden Araçlar menüsüne gidin. Açılan menüden "NuGet Paket Yöneticisi" üzerine gelin ve "Manage NuGet Packages for Solution..." seçeneğini seçin.

C# ile PDF'lerden Veri Çıkartma, Şekil 6: NuGet Paket Yöneticisine git NuGet Paket Yöneticisine Git

  • Bu, NuGet Paket Yöneticisi penceresini açacaktır. Gözat sekmesine gidin, aramaya IronPdf yazın ve Enter tuşuna basın.
  • Arama sonuçlarından IronPDF'yi seçin ve yüklemek için "Install" butonuna tıklayın.

C# ile PDF'lerden Veri Çıkartma, Şekil 7: NuGet Paket Yöneticisinden IronPDF paketini kur NuGet Paket Yöneticisinden IronPDF paketini kurun

PDF Dosyalarından Veri Çıkarma

IronPDF kullanarak veri çıkarma nasıl yapılır, aşağıdaki koda bir göz atalım:

// Import necessary namespaces
using IronPdf;
using System.Collections.Generic;
using System.Drawing;

public class PDFExtractor
{
    public void ExtractDataFromPDF()
    {
        // Open a 128-bit encrypted PDF file by providing the filename and password
        using PdfDocument pdf = PdfDocument.FromFile("encrypted.pdf", "password");

        // Extract all text from the PDF document
        string allText = pdf.ExtractAllText();

        // Extract all images from the PDF document
        IEnumerable<Image> allImages = pdf.ExtractAllImages();

        // Iterate over each page in the PDF document
        for (var index = 0; index < pdf.PageCount; index++)
        {
            int pageNumber = index + 1;

            // Extract text from the specific page
            string text = pdf.ExtractTextFromPage(index);

            // Extract images from the specific page
            IEnumerable<Image> images = pdf.ExtractImagesFromPage(index);

            // Code to process the extracted text and images
            //...
        }
    }
}
// Import necessary namespaces
using IronPdf;
using System.Collections.Generic;
using System.Drawing;

public class PDFExtractor
{
    public void ExtractDataFromPDF()
    {
        // Open a 128-bit encrypted PDF file by providing the filename and password
        using PdfDocument pdf = PdfDocument.FromFile("encrypted.pdf", "password");

        // Extract all text from the PDF document
        string allText = pdf.ExtractAllText();

        // Extract all images from the PDF document
        IEnumerable<Image> allImages = pdf.ExtractAllImages();

        // Iterate over each page in the PDF document
        for (var index = 0; index < pdf.PageCount; index++)
        {
            int pageNumber = index + 1;

            // Extract text from the specific page
            string text = pdf.ExtractTextFromPage(index);

            // Extract images from the specific page
            IEnumerable<Image> images = pdf.ExtractImagesFromPage(index);

            // Code to process the extracted text and images
            //...
        }
    }
}
' Import necessary namespaces
Imports IronPdf
Imports System.Collections.Generic
Imports System.Drawing

Public Class PDFExtractor
	Public Sub ExtractDataFromPDF()
		' Open a 128-bit encrypted PDF file by providing the filename and password
		Using pdf As PdfDocument = PdfDocument.FromFile("encrypted.pdf", "password")
	
			' Extract all text from the PDF document
			Dim allText As String = pdf.ExtractAllText()
	
			' Extract all images from the PDF document
			Dim allImages As IEnumerable(Of Image) = pdf.ExtractAllImages()
	
			' Iterate over each page in the PDF document
			For index = 0 To pdf.PageCount - 1
				Dim pageNumber As Integer = index + 1
	
				' Extract text from the specific page
				Dim text As String = pdf.ExtractTextFromPage(index)
	
				' Extract images from the specific page
				Dim images As IEnumerable(Of Image) = pdf.ExtractImagesFromPage(index)
	
				' Code to process the extracted text and images
				'...
			Next index
		End Using
	End Sub
End Class
$vbLabelText   $csharpLabel

Bu kod örneğinde:

  1. FromFile yöntemi, şifrelenmiş ve parola gerektiren girdi PDF belgesini yüklemek için kullanılır.
  2. ExtractAllText yöntemi, PDF'deki tüm metin içeriğini çıkarır.
  3. ExtractAllImages yöntemi, tüm gömülü resimleri alır.
  4. Bir döngü, her sayfa için belirli bir sayfadan metin ve resimler çıkartmak amacıyla ExtractTextFromPage ve ExtractImagesFromPage kullanarak belgedeki her sayfayı iteratif olarak işler.

Sonuç

IronPDF, geliştiricilerin PDF dosyalarından metin ve resimleri kolayca çıkarmalarına olanak tanır. ExtractAllText ve ExtractAllImages kullanarak bir PDF dosyasının tüm içeriği anında çıkartılabilir. Alternatif olarak, bu yöntemler belirli bir sayfadan içerik çıkarmak için kullanılabilir. Önceki kod, çeşitli sayfalardan metin ve resim okumak için her iki yöntemin nasıl kullanılacağını gösterdi.

Ayrıca, IronPDF şemalar işleme, barkod ekleme, parolalarla güvenliği artırma, filigran ekleme ve PDF formlarını programlı bir şekilde ele alma gibi özellikler sunar.

IronPDF, geliştirme sırasında ücretsizdir, ancak ticari kullanım için ödeme gereklidir. Ücret ödemeden üretim kullanımı için IronPDF'nin ücretsiz deneme sürümü mevcuttur.

İki IronPDF Lite Lisansı fiyatına Iron Software'in belge kütüphanelerinden oluşan tüm takımı satın alın.

Bugün PDF'lerden veri çıkarmaya başlamak için IronPDF'yi şimdi indirin!

Sıkça Sorulan Sorular

C#'da bir PDF'den metin nasıl alınır?

IronPDF'nin ExtractAllText yöntemini kullanarak bir PDF belgesinden tüm metni çıkarabilirsiniz. Bu yöntem, PDF'nin metin içeriğine kolay erişim sağlayarak süreci basitleştirir.

C# kullanarak bir PDF'ten görüntüleri çıkarmak için süreç nedir?

IronPDF ile, ExtractAllImages yöntemini kullanarak bir PDF'den görüntüleri çıkarabilirsiniz. Bu yöntem, PDF dosyasındaki tüm gömülü görüntüleri etkin bir şekilde alır.

Bir C# projesine PDF manipülasyon kütüphanesini nasıl yüklerim?

Bir C# projesine IronPDF kurmak için, Package Manager Console'da Install-Package IronPdf komutunu kullanabilir veya Visual Studio'daki NuGet Package Manager UI aracılığıyla paketi kurabilirsiniz.

C# ile şifreli PDF'leri işlemek mümkün mü?

Evet, IronPDF, FromFile yöntemini kullanarak şifreli PDF dosyalarını açmanıza ve üzerinde işlem yapmanıza olanak tanır; burada dosya adını ve içeriğe erişmek için parolayı sağlayabilirsiniz.

C# ile bir PDF'in belirli sayfalarından veri çıkarabilir miyim?

IronPDF, bir PDF belgesinin her sayfası üzerinde yineleme yapmanıza ve ExtractTextFromPage ve ExtractImagesFromPage gibi yöntemleri kullanarak belirli sayfalardan veri çıkarmanıza olanak tanır.

C# PDF kütüphanesi hangi ek özellikleri sağlar?

Veri çıkarımının yanı sıra, IronPDF grafik oluşturarak, barkod ekleyerek, belgelerin güvenliğini parolalarla artırarak, filigran ekleyerek ve PDF formlarını programlı olarak işleyerek çeşitli özellikler sunar.

HTML'yi C# içerisinde PDF'ye nasıl dönüştürebilirim?

IronPDF'in RenderHtmlAsPdf yöntemini kullanarak HTML dizelerini PDF'lere dönüştürebilir, bu da özellikle web içeriğinden PDF belgeleri oluşturmak için faydalıdır.

C# PDF kütüphanesi için bir deneme sürümü mevcut mu?

IronPDF, geliştirme sırasında ücretsiz olarak kullanılabilir ve yeteneklerini test etmenizi sağlar. Üretim kullanımı için ticari bir lisans gereklidir, ancak ücretsiz bir deneme de mevcuttur.

PDF'lerden veri çıkarımı için C# kütüphanesini kullanmaya nasıl başlayabilirim?

IronPDF ile veri çıkarmaya başlamak için kütüphaneyi indirin, Visual Studio'da bir C# projesi oluşturun veya açın, IronPDF'i yükleyin ve PDF'lerden metin ve görüntüleri verimli bir şekilde çıkarmak için kod örneklerini takip edin.

.NET 10 uyumluluğu: IronPDF’in veri çıkarma özelliklerini .NET 10 ile kullanabilir miyim?

Evet — IronPDF, metin ve resim çıkarma gibi veri çıkarma özellikleri dahil olmak üzere .NET 10 üzerinde tam desteklenmektedir. IronPDF'yi .NET 10 projelerinde özel bir yapılandırma gerektirmeden kullanabilirsiniz. .NET 10, .NET 9, .NET 8 ve önceki sürümleri ile .NET Standard ve .NET Framework'ü destekler. (ironpdf.com)

Curtis Chau
Teknik Yazar

Curtis Chau, Bilgisayar Bilimleri alanında Lisans Derecesine (Carleton Üniversitesi) sahip ve Node.js, TypeScript, JavaScript ve React konularında uzmanlaşmış ön uç geliştirmeyle ilgileniyor. Sezgisel ve estetik açıdan hoş kullanıcı arayüzleri oluşturma tutkunu, Curtis modern çerçevelerle çalışmayı ve iyi yapı...

Daha Fazla Oku

Iron Destek Ekibi

Haftada 5 gün, 24 saat çevrimiçiyiz.
Sohbet
E-posta
Beni Ara