Extraer imágenes de PDF
Contents
[
Hide
]
Cada página en el documento PDF contiene recursos (imágenes, formularios y fuentes). Podemos acceder a estos recursos llamando getResources método. Clase Recursos contienen XImageCollection y podemos obtener la lista de imágenes llamando a getImages método.
Así, para extraer la imagen de la página, necesitamos obtener una referencia a la página, luego a los recursos de la página y por último a la colección de imágenes. Imagen particular podemos extraer, por ejemplo, por índice.
El índice de la imagen devuelve un XImage objeto. Este objeto proporciona un Guardar método que se puede usar para guardar la imagen extraída. El siguiente fragmento de código muestra cómo extraer imágenes de un archivo PDF.
public void extractImage () {
// Open document
try {
document=new Document(inputStream);
} catch (Exception e) {
resultMessage.setText(e.getMessage());
return;
}
com.aspose.pdf.Page page=document.getPages().get_Item(1);
com.aspose.pdf.XImageCollection xImageCollection=page.getResources().getImages();
// Extract a particular image
com.aspose.pdf.XImage xImage=xImageCollection.get_Item(1);
File file=new File(fileStorage, "extracted-image.jpeg");
try {
java.io.FileOutputStream outputImage=new java.io.FileOutputStream(file.toString());
// Save output image
xImage.save(outputImage, ImageType.getJpeg());
outputImage.close();
} catch (java.io.IOException e) {
resultMessage.setText(e.getMessage());
return;
}
resultMessage.
}