Extraer imagen
IronPDF for Python puede extraer todas las imágenes incrustadas en un documento PDF — ya sea como archivos de imagen guardados o como objetos bitmap en memoria — con la capacidad de dirigir páginas específicas.
Empezando
Cargue un PdfDocument usando PdfDocument.FromFile, luego llame a ExtractAllImages para recuperar cada imagen en el documento, o a ExtractBitmapsFromPage para extraer imágenes de una página específica por su índice.
Entender el código
PdfDocument.FromFile(path, password): Abre el archivo PDF. El segundo argumento es la contraseña de descifrado; omítala para archivos no encriptados.ExtractAllImages(): Devuelve una lista de todas las imágenes encontradas en el documento a través de todas las páginas. Cada imagen en la lista es un objeto con un métodoSaveAspara escribirla en el disco.SaveAs(path): Guarda una imagen extraída en la ruta de archivo especificada. El formato del archivo está determinado por la extensión (.png,.jpg, etc.).ExtractBitmapsFromPage(pageIndex): Devuelve una lista de objetosAnyBitmappara todas las imágenes en el índice de página especificado basado en cero. Use esto cuando necesite trabajar con datos de imagen en memoria en lugar de escribir en archivos.
Patrón de Iteración
El ejemplo itera sobre ExtractAllImages() usando enumerate para asignar un índice secuencial único a cada nombre de archivo de imagen, evitando sobrescrituras cuando se extraen múltiples imágenes del mismo documento.
¡Aprende a trabajar con imágenes PDF usando IronPDF for Python!






