IRONSOFTWAREHOME
USANDO IRONPDF FOR JAVA

Cómo Leer Archivo PDF en Java

Curtis Chau
Curtis Chau
Updated: 21 de abril de 2026

Este artículo explorará cómo crear un lector de PDF, para abrir un archivo PDF en su aplicación de software programáticamente. Para realizar esta tarea de manera efectiva, IronPDF for Java es una biblioteca del sistema que ayuda a abrir y leer archivos PDF utilizando el nombre del archivo en programas Java.

IronPDF

La IronPDF - Biblioteca Java está construida sobre el ya exitoso .NET Framework. Esto hace de IronPDF una herramienta versátil para trabajar con documentos PDF en comparación con otras bibliotecas de clases como Apache PDFBox. Proporciona la facilidad para extraer y analizar contenido, cargar texto y cargar imágenes. También ofrece opciones para personalizar las páginas PDF, tales como el diseño de página, márgenes, cabecera y pie de página, orientación de página y mucho más.

Además de esto, IronPDF también admite la conversión de otros formatos de archivo, la protección de PDFs con contraseña, la firma digital, la fusión y división de documentos PDF.

Cómo leer archivos PDF en Java

Prerrequisitos

Para usar IronPDF para hacer un lector de PDF en Java, es necesario asegurarse de que los siguientes componentes estén instalados en la computadora:

  1. JDK - Se requiere el Kit de Desarrollo de Java para construir y ejecutar programas Java. Si no está instalado, descárguelo desde el Sitio Web de Oracle.
  2. IDE - El Entorno de Desarrollo Integrado es un software que ayuda a escribir, editar y depurar un programa. Descargue cualquier IDE for Java, por ejemplo, Eclipse, NetBeans, IntelliJ.
  3. Maven - Maven es una herramienta de automatización que ayuda a descargar bibliotecas del Repositorio Central. Descárguelo desde el Sitio Web de Apache Maven.
  4. IronPDF - Finalmente, se requiere IronPDF para leer el archivo PDF en Java. Esto debe añadirse como una dependencia en su Proyecto Maven de Java. Incluya el artefacto IronPDF junto con la dependencia slf4j en el archivo pom.xml, tal y como se muestra en el ejemplo siguiente:
<!-- Add Maven dependencies for IronPDF -->
<dependencies>
    <!-- IronPDF Dependency -->
    <dependency>
        <groupId>com.ironsoftware</groupId>
        <artifactId>ironpdf</artifactId>
        <version>your-version-here</version>
    </dependency>

    <!-- SLF4J Dependency necessary for logging -->
    <dependency>
        <groupId>org.slf4j</groupId>
        <artifactId>slf4j-api</artifactId>
        <version>1.7.32</version>
    </dependency>
</dependencies>
XML

Añadir las importaciones necesarias

Primero, añada el siguiente código en la parte superior del archivo fuente de Java para referenciar todos los métodos requeridos de IronPDF:

import com.ironsoftware.ironpdf.*;
// Necessary imports from IronPDF library
Java

A continuación, configure IronPDF con una clave de licencia válida para usar sus métodos. Invoca el método setLicenseKey en el método principal.

License.setLicenseKey("Your license key");
// Set your IronPDF license key - required for full version
Java

Nota: Puede obtener una clave de licencia de prueba gratuita para crear, leer e imprimir PDFs.

Leer un archivo PDF existente en Java

Para leer archivos PDF, deben existir archivos PDF, o se puede crear uno. Este artículo usará un archivo PDF ya creado. El código es simple y un proceso de dos pasos para extraer texto del documento:

// Load the PDF document from file
PdfDocument pdf = PdfDocument.fromFile(Paths.get("assets/sample.pdf"));
// Extract all text from the PDF
String text = pdf.extractAllText();
// Print the extracted text
System.out.println(text);
Java

En el código anterior, [fromFile](/java/object-reference/api/com/ironsoftware/ironpdf/PdfDocument.html#fromFile(java.nio.file.Path) abre un documento PDF. El método Paths.get obtiene el directorio del archivo y está listo para extraer el contenido del mismo. A continuación, [extractAllText](/java/object-reference/api/com/ironsoftware/ironpdf/PdfDocument.html#extractAllText() lee todo el texto del documento.

El resultado es:

Cómo leer un archivo PDF en Java, Figura 1: Lectura de texto PDF Resultado de Lectura de Texto en PDF

Leer texto de una página específica

IronPDF también puede leer contenido de una página específica en un PDF. El método extractTextFromPage utiliza un objeto PageSelection para aceptar un rango de páginas de las que se leerá el texto.

En el siguiente ejemplo, se extrae el texto de la segunda página del documento PDF. PageSelection.singlePage toma el índice de la página que se debe extraer (el índice comienza en 0).

// Load the PDF document from file
PdfDocument pdf = PdfDocument.fromFile(Paths.get("assets/sample.pdf"));
// Extract text from the second page (page index based, starts at 0, so 1 means second page)
String text = pdf.extractTextFromPage(PageSelection.singlePage(1));
// Print the extracted text from the specified page
System.out.println(text);
Java

Cómo leer un archivo PDF en Java, Figura 2: Lectura de texto PDF Resultado de Lectura de Texto en PDF

Otros métodos disponibles en la clase PageSelection que pueden utilizarse para extraer texto de diversas páginas incluyen: [firstPage](/java/object-reference/api/com/ironsoftware/ironpdf/edit/PageSelection.html#lastPage(), [lastPage](/java/object-reference/api/com/ironsoftware/ironpdf/edit/PageSelection.html#firstPage(), [pageRange](/java/object-reference/api/com/ironsoftware/ironpdf/edit/PageSelection.html#pageRange(int,int) y [allPages](/java/object-reference/api/com/ironsoftware/ironpdf/edit/PageSelection.html#allPages().

Leer texto de un archivo PDF recién generado

La búsqueda de texto también se puede realizar en un archivo PDF recién generado desde un archivo HTML o URL. El siguiente código de ejemplo genera PDFs desde URL y extrae todo el texto del sitio web.

// Generate PDF from a URL
PdfDocument pdf = PdfDocument.renderUrlAsPdf("https://unsplash.com/");
// Extract all text from the generated PDF
String text = pdf.extractAllText();
// Print the extracted text from the URL
System.out.println("Text extracted from the website: " + text);
Java

Cómo leer un archivo PDF en Java, Figura 3: Leer desde un archivo nuevo Leer desde un Nuevo Archivo

IronPDF también se puede usar para extraer imágenes de archivos PDF.

El código completo es el siguiente:

import com.ironsoftware.ironpdf.License;
import com.ironsoftware.ironpdf.PdfDocument;
import com.ironsoftware.ironpdf.edit.PageSelection;

import java.io.IOException;
import java.nio.file.Paths;

public class Main {
    public static void main(String[] args) throws IOException {
        // Set the IronPDF license key for commercial use
        License.setLicenseKey("YOUR LICENSE KEY HERE");

        // Read text from a specific page in an existing PDF
        PdfDocument pdf = PdfDocument.fromFile(Paths.get("assets/sample.pdf"));
        String text = pdf.extractTextFromPage(PageSelection.singlePage(1));
        System.out.println(text);

        // Read all text from a PDF generated from a URL
        pdf = PdfDocument.renderUrlAsPdf("https://unsplash.com/");
        text = pdf.extractAllText();
        System.out.println("Text extracted from the website: " + text);
    }
}
Java

Resumen

Este artículo explicó cómo abrir y leer PDFs en Java usando IronPDF.

IronPDF ayuda a crear fácilmente PDFs desde HTML o URL y convertir desde diferentes formatos de archivo. También ayuda a realizar tareas de PDF de manera rápida y fácil.

Pruebe IronPDF por 30 días con una prueba gratuita y descubra qué tan bien funciona para usted en producción. Explora las opciones de licencias comerciales de IronPDF, que empiezan desde solo $999.

Curtis Chau
Escritor Técnico

Curtis Chau tiene una licenciatura en Ciencias de la Computación (Carleton University) y se especializa en el desarrollo front-end con experiencia en Node.js, TypeScript, JavaScript y React. Apasionado por crear interfaces de usuario intuitivas y estéticamente agradables, disfruta trabajando con frameworks modernos y creando manuales bien estructurados y visualmente atractivos.

...
Leer más

Artículos Relacionados

Key in blue circle

Obtenga su clave de prueba gratuita de 30 días al instante.

Your trial license will be sent to your email address

Sin limitaciones. 100 % desbloqueado. Sin tarjeta de crédito.

OR
bullet_checkedNo se requiere tarjeta de crédito ni creación de cuentaSin limitaciones. 100 % desbloqueado. Sin tarjeta de crédito.
  • Logo Aetna
  • Logo NASA
  • Logo GE
  • Logo Porsche
  • Logo USDA
  • Logo Qatar
Join Millions of Engineers who’ve tried Iron Suite
Reserve su Demostración en Vivo gratuita
Booking Badge

Confiado por millones de ingenieros en todo el mundo

Logos de clientes de Iron Software
Obtén tu Consulta Sin Compromiso
Completa el formulario a continuación o envía un correo a sales@ironsoftware.com
Tus detalles siempre serán mantenidos confidenciales.
Confiado por millones de ingenieros en todo el mundo
Logos de clientes de Iron Software
Obtenga su Clave de Prueba de 30 días gratis al instante.
No se requiere tarjeta de crédito ni creación de cuenta
Biblioteca C# NuGet para PDF
Instalar con NuGet

Versión: 2026.9

PM > Install-Package IronPdf
nuget.org/packages/IronPdf/
  1. En el Explorador de Soluciones, haga clic derecho en Referencias, Administrar Paquetes NuGet
  2. Seleccione Examinar y busque "IronPDF"
  3. Seleccione el paquete e instale
C# PDF DLL
Descargar DLL

Versión: 2026.9

o descargue el Instalador de Windows aquí.

  1. Descargue y descomprima IronPDF en una ubicación como ~/Libs dentro del directorio de su solución
  2. En el Explorador de Soluciones de Visual Studio, haga clic derecho en Referencias. Seleccione Examinar, "IronPDF.dll"

Licencias desde $999