IRONSOFTWAREHOME

Extract Embedded Text and Images from PDFs in C#

Curtis Chau
Curtis Chau
Updated: 16 Şubat 2026

C# ile PDF belgelerinden hem metin içerik hem de görüntüleri basit metot çağrıları ile çıkarın. Diğer uygulamalarda düzenleme, analiz veya yeniden amaçlandırma için gömülü içeriği alın.

Metin ve resim çıkarma, PDF belgelerinden metinsel içeriği ve grafik öğeleri alır. İçeriğe erişin ve düzenleme, arama yapma, metni diğer formatlara dönüştürme veya yeniden kullanım için görselleri kaydetmek amacıyla içeriği yeniden değerlendirin. İster PDF'leri C# içinde ayrıştırmak yoluyla veri analizi, ister içerikleri aranabilir formatlara dönüştürmek veya görsel öğeleri arşivlemek için çıkarmak isteyin, IronPDF kapsamlı çıkarma araçları sağlar.

IronPDF kullanarak metin ve resimleri çıkarın. Çıkarılan görüntüleri diske kaydedin veya yeni belgelere yerleştirmeden önce başka bir formata dönüştürün. Bu esneklik, içerik dönüşümünü gerektiren iş akışlarını destekler, örneğin PDF'leri HTML'ye dönüştürmek veya çıkarılan görüntüleri yeniden kullanmak gibi.

Hızlı Başlangıç: IronPDF ile Metin ve Görüntü Çıkarma

PDF dosyalarından metin ve resimleri sadece birkaç satır kodla çıkarın. Bu hızlı başlangıç, içerik yeniden kullanımı ve analiz için PDF belgelerinden gömülü içeriğin nasıl alınacağını gösterir. IronPDF'nin kesintisiz çözümü ile düzenleme için metin çıkarın veya ileride kullanmak üzere görüntüleri kaydedin.

  1. 1Install IronPDF with NuGet Package Manager

    PM > Install-Package IronPdf

  2. 2Bu kod parçacığını kopyalayın ve çalıştırın.

    var pdf = new IronPdf.PdfDocument("sample.pdf");  
    string text = pdf.ExtractAllText();  
    var images = pdf.ExtractAllImages();  
    C#
  3. 3Canlı ortamınızda test için dağıtım yapın

    Ücretsiz deneme ile bugün projenizde IronPDF kullanmaya başlayın
    arrow pointer

PDF'lerden Metin Nasıl Çıkarılır?

Hem yeni oluşturulmuş hem de mevcut PDF belgelerinden metin çıkarın. Belgeden gömülü metni çıkarmak için ExtractAllText yöntemini kullanın. Yöntem, PDF'deki tüm metni içeren bir dize döndürür. Sayfalar, ardışık dört yeni satır karakteriyle ayrılır. Bu örnek, Wikipedia web sitesinden render edilen bir örnek PDF kullanır.

PDF'lerle çalışırken uluslararası diller ve UTF-8 karakterleri içeren, IronPDF uygun kodlama ve karakter temsilini korur. Bu, Latin olmayan yazılar ve özel karakterlerin doğru görüntülenmesini sağlar.

using IronPdf;
using System.IO;

PdfDocument pdf = PdfDocument.FromFile("sample.pdf");

// Extract text
string text = pdf.ExtractAllText();

// Export the extracted text to a text file
File.WriteAllText("extractedText.txt", text);
Wikipedia sayfasının ve çıkarılmış düz metnin yan yana görünümü, metin çıkarma sürecini gösteriyor

Metni Belirli Koordinatlarla Nasıl Çıkarabilirim?

Her bir PDF sayfasındaki metin satırlarının ve karakterlerinin koordinatlarını alın. PDF'den bir sayfa seçin ve Lines ile Characters özelliklerine erişin. Koordinatlar, metin konumunu temsil eden Top, Right, Bottom ve Left değerlerini içerir. Bu özellik, mekansal yerleşimi korur ve metin konumu analizini mümkün kılar.

Belge yapısını korumak ve ileri düzey metin analizini uygulamak için konum farkındalığına sahip C# dilinde PDF dosyalarını okuması gereken geliştiriciler için, koordinat çıkarımı veri sağlar.

using IronPdf;
using System.IO;
using System.Linq;

// Open PDF from file
PdfDocument pdf = PdfDocument.FromFile("sample.pdf");

// Extract text by lines
var lines = pdf.Pages[0].Lines;

// Extract text by characters
var characters = pdf.Pages[0].Characters;

File.WriteAllLines("lines.txt", lines.Select(l => $"at Y={l.BoundingBox.Bottom:F2}: {l.Contents}"));
Wikipedia ana sayfasını ve Y-koordinatlarını gösteren, ayrıştırılmış içeriğe sahip bir metin dosyasını içeren bölünmüş ekran

PDF'lerden Görüntüleri Nasıl Çıkarırım?

Belgedeki tüm gömülü resimleri çıkarmak için ExtractAllImages yöntemini kullanın. Yöntem, resimleri AnyBitmap nesnelerinin List listesi olarak döndürür. Aynı belgeyi kullanarak, görüntüleri çıkardık ve 'images' klasörüne aktardık. Bu işlevsellik, görüntü arşivleme, içerik taşıma ve PDF sayfalarını görüntülere rasterleştirme işlemlerine destek verir ve daha ileri işlemler için kullanılabilir.

Çıkarılan görüntüler, orijinal kalitesini korur ve PNG, JPEG ve BMP dahil olmak üzere çeşitli formatlarda kaydedilebilir. Bulut depolama iş akışları için, bu işlevselliği Azure Blob Storage ile görüntü yönetimi ile entegre edin.

using IronPdf;

PdfDocument pdf = PdfDocument.FromFile("sample.pdf");

// Extract images
var images = pdf.ExtractAllImages();

for(int i = 0; i < images.Count; i++)
{
    // Export the extracted images
    images[i].SaveAs($"images/image{i}.png");
}
Dosya Gezgini, görüntü çıkarma aracını çalıştırdıktan sonra küçük resim görünümünde 19 çıkarılmış PNG görüntüsünü gösteriyor

Görüntü Çıkartma İçin Farklı Yöntemler Nelerdir?

ExtractAllImages yönteminin ötesinde, görüntü bilgilerini çıkarmak için ExtractAllBitmaps ve ExtractAllRawImages yöntemlerini kullanın. ExtractAllBitmaps, AnyBitmap nesnelerinin List listesini döndürürken, ExtractAllRawImages tüm resimleri çıkarır ve onları ham byte[] (byte[]) olarak döndürür.

Bu yöntem, resim verisini bellek içinde işlerken veya bayt dizisi girişi gerektiren sistemlerle bütünleştirirken iyi çalışır. PDF'leri bellek akışlarına aktarma senaryoları için buraya tıklayın. Ham bayt dizisi formatı en iyi esnekliği sağlar.


Bu türden favori kütüphanem IronPDF'dir. PDF dosyalarının hızlı ve verimli bir şekilde işlenmesine olanak tanır. Ayrıca, PDF/A formatına dışa aktarma ve dijital imzalama gibi birçok değerli özelliğe sahiptir.

Milan Jovanovic

Microsoft MVP

Vaka çalışmasını görüntüle

IronOCR, manuel işleme maliyetinden yıllık 40.000 USD tasarruf etmemizi sağlıyor, üretkenliği artırıyor ve yüksek etkili görevler için kaynakları serbest bırakıyor. Kesinlikle tavsiye ederim.

Brent Matzelle

Teknoloji Müdürü, OPYN

Vaka çalışmasını görüntüle

IronSuite, operasyonlarımızda kritik bir rol oynar. Bunlar, iş süreçlerinde verimliliği artıran, kat planları oluşturmak ve envanter yönetimini geliştirmek gibi araçlardır.

David Jones

Baş Yazılım Mühendisi, Agorus Build

Vaka çalışmasını görüntüle

Belirli PDF Sayfalarından İçerik Nasıl Çıkarırım?

Belirtilen tek veya birden fazla sayfadan metin ve görselleri çıkartın. Metin çıkarmak için ExtractTextFromPage ve ExtractTextFromPages yöntemlerini kullanın. Resimler için ExtractImagesFromPage ve ExtractImagesFromPages yöntemlerini kullanın.

Bu ayrıntılı kontrol, yalnızca belirli bölümlerin ilgili içeriği içerdiği büyük belgelerle çalışırken yardımcı olur. PDF'leri bölmek ve ayrı işlem için bireysel sayfaları çıkarmak için özellikler de destekleniyor.

using IronPdf;

PdfDocument pdf = PdfDocument.FromFile("sample.pdf");

// Extract text from page 1
string textFromPage1 = pdf.ExtractTextFromPage(0);

int[] pages = new[] { 0, 2 };

// Extract text from pages 1 & 3
string textFromPage1_3 = pdf.ExtractTextFromPages(pages);

Ne Zaman Tüm Sayfalar Yerine Belirli Sayfalardan Çıkartmalıyım?

Belirli sayfalardan çıkarın ne zaman:

  • Belirli bölümlerinde ilgili veri içeren büyük PDF'lerle çalışmak
  • Sayfaları bağımsız olarak işlerken iş akışlarını uygulama
  • Artımlı içerik ekranı veya işleme gerektiren uygulamalar geliştirme
  • Sadece gerekli sayfaları işleyerek bellek kullanımını optimize etme
  • Sayfa özel arama veya indeksleme işlevselliği oluşturma

Hangi Performans Dikkatlerini Bilmeliyim?

PDF içeriğini çıkarmak istediğinizde şu performans faktörlerini göz önünde bulundurun:

  • Bellek Kullanımı: Büyük belgelerden sayfaları tek tek çıkararak bellek tüketimini minimize edin
  • İşlem Süresi: Çok sayfalı ekstraksiyonlarda uygun olduğunda paralel işlem kullanın
  • Dosya Boyutu: Yüksek çözünürlüklü görüntüler içeren daha büyük PDF'ler daha fazla işlem süresi gerektirir
  • Depolama: Çok sayıda yüksek çözünürlüklü görüntü çıkarımı için yeterli disk alanı planlayın
  • Threading: IronPDF, çok çekirdekli sistemlerde performansı artırmak için çoklu iş parçacığı işlemlerini destekler

En iyi performans için, bellekteki PDF'lerle çalışırken, disk I/O yükünü azaltmak amacıyla bellek akışı işlemleri kullanın.

Sıkça Sorulan Sorular

C#'da PDF belgelerinden metin nasıl çıkarılır?

IronPDF'nin ExtractAllText yöntemiyle PDF belgelerinden gömülü metin çıkarın. Yöntem, PDF'deki tüm metni içeren bir dize döndürür, sayfalar dört ardışık yeni satır karakteri ile ayrılır. IronPDF, uluslararası diller ve UTF-8 karakterleri için doğru kodlamayı sürdürür.

PDF dosyalarından programlı olarak görüntü çıkarabiliyor muyum?

Evet, IronPDF PDF belgelerinden grafik öğeleri almak için ExtractAllImages yöntemini sağlar. Çıkarılan görüntüleri diske kaydedebilir veya yeni belgelerde gömmeden önce diğer formatlara dönüştürebilirsiniz.

PDF içerik çıkarımı için ana kullanım alanları nelerdir?

IronPDF'nin çıkarma araçları, veri analizi için PDF'leri ayrıştırmak, içeriği aranabilir formatlara dönüştürmek, arşivleme için görsel öğeler çıkarmak ve düzenleme veya diğer formatlara dönüştürme için içerik yeniden kullanma gibi çeşitli iş akışlarını destekler.

PDF içeriğinin çıkarılması ne kadar kod satırı gerektirir?

IronPDF ile birkaç kod satırı içinde metin ve görüntüleri çıkarabilirsiniz. Basitçe PDF belgenizi yükleyin ve metin çıkarımı için ExtractAllText() veya görüntü çıkarımı için ExtractAllImages() yöntemini çağırın.

Tüm belge yerine belirli sayfalardan içerik çıkarabilir miyim?

Evet, IronPDF PDF belgelerinizden hangi içeriği çıkarmak istediğinize ilişkin kesin kontrol sağlayarak metin ve görüntüleri hangi sayfalardan çıkaracağınızı belirlemenize olanak tanır.

How can IronPDF assist with extracting text from PDFs containing international languages?

IronPDF maintains proper encoding and character representation for international languages and UTF-8 characters, ensuring correct text extraction and display for non-Latin scripts and special characters.

Is it possible to extract images from a PDF for use in Azure Blob Storage using IronPDF?

Yes, IronPDF's image extraction capabilities are compatible with Azure Blob Storage workflows, allowing you to save extracted images in various formats and manage them effectively in the cloud.

Does IronPDF support extracting text from specific layers within a PDF?

Yes, IronPDF can extract text from specific layers (OCGs) within a PDF using the `ExtractTextFromLayer` and `GetTextObjectsByLayer` methods, which target content grouped in named layers like CAD drawings or map exports.

Curtis Chau
Teknik Yazar

Curtis Chau, Bilgisayar Bilimleri alanında Lisans Derecesine (Carleton Üniversitesi) sahip ve Node.js, TypeScript, JavaScript ve React konularında uzmanlaşmış ön uç geliştirmeyle ilgileniyor. Sezgisel ve estetik açıdan hoş kullanıcı arayüzleri oluşturma tutkunu, Curtis modern çerçevelerle çalışmayı ve iyi yapılandırılmış, görsel olarak çekici kılavuzlar oluşturmayı seviyor.

...
Daha Fazla Oku

Başlamaya Hazır mısınız?

Nuget Downloads 20,756,830Sürüm:2026.7yeni yayınlandı

ÜCRETSİZİNİZİ EDİNİN

30 günlük Deneme Anahtarınızı anında edinin.

bullet_checkedKredi kartı veya hesap oluşturma gerektirmez
bullet_testÜretimde Test
filigran olmadan
bullet_calendar30 gün tamamen
işlevsel ürün
bullet_supportDeneme sırasında teknik
24/5 destek
Ücretsiz 30 Günlük Deneme Anahtarınızı anında alın.
Kredi kartı veya hesap oluşturma gerektirmez
PDF için C# NuGet Kütüphanesi
NuGet ile yükleyin

Sürüm: 2026.7

PM > Install-Package IronPdf
nuget.org/packages/IronPdf/
  1. Çözüm Gezgini'nde Referanslar'a sağ tıklayın, NuGet Paketlerini Yönet
  2. Tarayıcıya tıklayın ve "IronPdf" arayın
  3. Paketi seçin ve yükleyin
C# PDF DLL
DLL İndir

Sürüm: 2026.7

veya Windows Yükleyiciyi şuradan buradan indirin.

  1. IronPDF'i, ~/Libs gibi bir yere, Solution dizininiz içinde indirin ve açın.
  2. Visual Studio Çözüm Gezgini'nde, Referanslar'a sağ tıklayın. Tarayıcı sekmesini seçin, "IronPdf.dll"

Lisanslar $999

Key in blue circle

Ücretsiz 30 günlük Deneme Anahtarınızı anında edinin.

Your trial license will be sent to your email address

Herhangi bir sınırlama yoktur. %100 erişim. Kredi kartı gerekmez.

bullet_checkedKredi kartı veya hesap oluşturma gerektirmezHerhangi bir sınırlama yoktur. %100 erişim. Kredi kartı gerekmez.
  • Logo Aetna
  • Logo NASA
  • Logo GE
  • Logo Porsche
  • Logo USDA
  • Logo Qatar
Join Millions of Engineers who’ve tried IronPDF
Ücretsiz Canlı Demo rezervasyonu yapın
Booking Badge

Dünya Çapında Milyonlarca Mühendisin Güvendiği

Iron Software müşteri logoları
Bağımsız Danışmanlık Alın
Aşağıdaki formu doldurun veya sales@ironsoftware.com adresine e-posta gönderin
Bilgileriniz daima gizli kalacaktır.
Dünya Çapında Milyonlarca Mühendisin Güvendiği
Iron Software müşteri logoları
Ücretsiz 30 Günlük Deneme Anahtarınızı anında alın.
Kredi kartı veya hesap oluşturma gerektirmez