
Java에서 PDF 파일을 읽는 방법
이 글에서는 소프트웨어 애플리케이션에서 PDF 파일을 프로그램적으로 열 수 있는 PDF 리더를 만드는 방법을 살펴보겠습니다. 이 작업을 효과적으로 수행하기 위해 Java용 IronPDF 는 Java 프로그램에서 파일 이름을 사용하여 PDF 파일을 열고 읽을 수 있도록 도와주는 시스템 라이브러리 중 하나입니다.
Java에서 PDF 파일을 읽는 방법
- IronPDF 자바 라이브러리를 다운로드하세요.
fromFile메서드를 사용하여 기존 PDF 문서를 불러오세요.- PDF에서 내장된 텍스트를 추출하려면
extractAllText메서드를 호출하세요. extractTextFromPage메서드를 사용하여 특정 페이지에서 텍스트를 추출합니다.- URL에서 렌더링된 PDF에서 텍스트를 추출합니다.
IronPDF
IronPDF - Java 라이브러리 는 이미 성공적인 .NET Framework 기반으로 구축되었습니다. 이러한 특징 덕분에 IronPDF Apache PDFBox와 같은 다른 클래스 라이브러리에 비해 PDF 문서를 다루는 데 있어 더욱 다재다능한 도구입니다. 이 프로그램은 콘텐츠 추출 및 구문 분석 , 텍스트 로드, 이미지 로드 기능을 제공합니다. 또한 페이지 레이아웃 , 여백, 머리글 및 바닥글 , 페이지 방향 등 PDF 페이지를 사용자 지정할 수 있는 다양한 옵션을 제공합니다.
이 외에도 IronPDF 다른 파일 형식에서 PDF로의 변환, 암호로 PDF 보호, 디지털 서명, PDF 문서 병합 및 분할 기능을 지원합니다.
Java에서 PDF 파일을 읽는 방법
필수 조건
IronPDF 사용하여 Java PDF 리더를 만들려면 컴퓨터에 다음 구성 요소가 설치되어 있는지 확인해야 합니다.
- JDK (Java Development Kit)는 Java 프로그램을 빌드하고 실행하는 데 필요합니다. 설치되어 있지 않다면 오라클 웹사이트 에서 다운로드하십시오.
- IDE (통합 개발 환경)는 프로그램을 작성, 편집 및 디버깅하는 데 도움이 되는 소프트웨어입니다. Eclipse, NetBeans, IntelliJ 등 Java용 IDE를 다운로드하세요.
- Maven - Maven은 중앙 저장소에서 라이브러리를 다운로드하는 데 도움이 되는 자동화 도구입니다. 아파치 Maven 웹사이트 에서 다운로드하세요.
- IronPDF - 마지막으로, Java에서 PDF 파일을 읽으려면 IronPDF 필요합니다. 이 라이브러리를 Java Maven 프로젝트의 종속성으로 추가해야 합니다. 다음 예제에 표시된 대로
pom.xml파일에 IronPDF 아티팩트와 slf4j 종속성을 포함하세요:
<!-- Add Maven dependencies for IronPDF -->
<dependencies>
<!-- IronPDF Dependency -->
<dependency>
<groupId>com.ironsoftware</groupId>
<artifactId>ironpdf</artifactId>
<version>your-version-here</version>
</dependency>
<!-- SLF4J Dependency necessary for logging -->
<dependency>
<groupId>org.slf4j</groupId>
<artifactId>slf4j-api</artifactId>
<version>1.7.32</version>
</dependency>
</dependencies>
필수 임포트 추가
먼저, IronPDF 에서 필요한 모든 메서드를 참조하도록 Java 소스 파일 맨 위에 다음 코드를 추가하십시오.
import com.ironsoftware.ironpdf.*;
// Necessary imports from IronPDF library
다음으로, IronPDF의 메서드를 사용하려면 유효한 라이선스 키로 IronPDF 구성하십시오. main 메서드에서 setLicenseKey 메서드를 호출합니다.
License.setLicenseKey("Your license key");
// Set your IronPDF license key - required for full version
참고: PDF 파일을 생성, 읽기 및 인쇄할 수 있는 무료 평가판 라이선스 키를 받을 수 있습니다.
자바를 이용해 기존 PDF 파일 읽기
PDF 파일을 읽으 려면 PDF 파일이 있어야 하거나, PDF 파일을 새로 만들어야 합니다. 이 문서에서는 이미 생성된 PDF 파일을 사용합니다. 코드는 간단하며 문서에서 텍스트를 추출하는 두 단계 과정입니다.
// Load the PDF document from file
PdfDocument pdf = PdfDocument.fromFile(Paths.get("assets/sample.pdf"));
// Extract all text from the PDF
String text = pdf.extractAllText();
// Print the extracted text
System.out.println(text);
위 코드에서 fromFile이 PDF 문서를 엽니다. Paths.get 메서드는 파일의 디렉터리를 가져오고, 파일에서 콘텐츠를 추출할 준비가 됩니다. 그런 다음, [extractAllText](/java/object-reference/api/com/ironsoftware/ironpdf/PdfDocument.html#extractAllText()은 문서의 모든 텍스트를 읽습니다.
출력 결과는 다음과 같습니다.
PDF 텍스트 출력 읽기
특정 페이지에서 텍스트 읽기
IronPDF PDF 파일의 특정 페이지 내용을 읽을 수도 있습니다. extractTextFromPage 메서드는 PageSelection 객체를 사용하여 텍스트를 읽을 페이지 범위를 허용합니다.
다음 예시에서는 PDF 문서의 두 번째 페이지에서 텍스트를 추출했습니다. PageSelection.singlePage은(는) 추출해야 하는 페이지의 인덱스를 가져옵니다(인덱스는 0부터 시작).
// Load the PDF document from file
PdfDocument pdf = PdfDocument.fromFile(Paths.get("assets/sample.pdf"));
// Extract text from the second page (page index based, starts at 0, so 1 means second page)
String text = pdf.extractTextFromPage(PageSelection.singlePage(1));
// Print the extracted text from the specified page
System.out.println(text);
PDF 텍스트 출력 읽기
다양한 페이지에서 텍스트를 추출하는 데 사용할 수 있는 PageSelection 클래스의 다른 메서드로는: firstPage, lastPage, [pageRange](/java/object-reference/api/com/ironsoftware/ironpdf/edit/PageSelection.html#pageRange(int,int), allPages 등이 있습니다.
새로 생성된 PDF 파일에서 텍스트 읽기
새로 생성된 PDF 파일에서 HTML 파일이나 URL을 사용하여 텍스트를 검색할 수도 있습니다. 다음 샘플 코드는 URL에서 PDF를 생성하고 웹사이트의 모든 텍스트를 추출합니다.
// Generate PDF from a URL
PdfDocument pdf = PdfDocument.renderUrlAsPdf("https://unsplash.com/");
// Extract all text from the generated PDF
String text = pdf.extractAllText();
// Print the extracted text from the URL
System.out.println("Text extracted from the website: " + text);
새 파일에서 읽기
IronPDF PDF 파일에서 이미지를 추출하는 데에도 사용할 수 있습니다.
전체 코드는 다음과 같습니다.
import com.ironsoftware.ironpdf.License;
import com.ironsoftware.ironpdf.PdfDocument;
import com.ironsoftware.ironpdf.edit.PageSelection;
import java.io.IOException;
import java.nio.file.Paths;
public class Main {
public static void main(String[] args) throws IOException {
// Set the IronPDF license key for commercial use
License.setLicenseKey("YOUR LICENSE KEY HERE");
// Read text from a specific page in an existing PDF
PdfDocument pdf = PdfDocument.fromFile(Paths.get("assets/sample.pdf"));
String text = pdf.extractTextFromPage(PageSelection.singlePage(1));
System.out.println(text);
// Read all text from a PDF generated from a URL
pdf = PdfDocument.renderUrlAsPdf("https://unsplash.com/");
text = pdf.extractAllText();
System.out.println("Text extracted from the website: " + text);
}
}
요약
이 글에서는 IronPDF 사용하여 Java에서 PDF 파일을 열고 읽는 방법을 설명했습니다.
IronPDF HTML 또는 URL에서 PDF를 쉽게 생성하고 다양한 파일 형식을 변환할 수 있도록 도와줍니다. 또한 PDF 관련 작업을 빠르고 쉽게 완료하는 데 도움이 됩니다.
IronPDF 30일 동안 무료 체험 해 보시고 실제 업무 환경에서 얼마나 유용한지 직접 확인해 보세요. IronPDF의 상업적 라이선싱 옵션을 $999부터 시작하는 가격으로 탐색하세요.

커티스 차우는 칼턴 대학교에서 컴퓨터 과학 학사 학위를 취득했으며, Node.js, TypeScript, JavaScript, React를 전문으로 하는 프론트엔드 개발자입니다. 직관적이고 미적으로 뛰어난 사용자 인터페이스를 만드는 데 열정을 가진 그는 최신 프레임워크를 활용하고, 잘 구성되고 시각적으로 매력적인 매뉴얼을 제작하는 것을 즐깁니다.
관련 기사


