Extrair imagens de PDF

Contents
[ ]

Cada página em um documento PDF contém recursos (imagens, formulários e fontes). Podemos acessar esses recursos chamando getResources método. Classe Recursos contém XImageCollection e podemos obter lista de imagens chamando getImages método.

Assim, para extrair a imagem da página, precisamos obter referência à página, em seguida aos recursos da página e, por último, à coleção de imagens. Imagem específica que podemos extrair, por exemplo, por índice.

O índice da imagem retorna um XImage objeto. Este objeto fornece um Save método que pode ser usado para salvar a imagem extraída. O trecho de código a seguir mostra como extrair imagens de um arquivo PDF.

public void extractImage () {
       // Open document
       try {
           document=new Document(inputStream);
       } catch (Exception e) {
           resultMessage.setText(e.getMessage());
           return;
       }

       com.aspose.pdf.Page page=document.getPages().get_Item(1);
       com.aspose.pdf.XImageCollection xImageCollection=page.getResources().getImages();
       // Extract a particular image
       com.aspose.pdf.XImage xImage=xImageCollection.get_Item(1);
       File file=new File(fileStorage, "extracted-image.jpeg");
       try {
           java.io.FileOutputStream outputImage=new java.io.FileOutputStream(file.toString());
           // Save output image
           xImage.save(outputImage, ImageType.getJpeg());
           outputImage.close();
       } catch (java.io.IOException e) {
           resultMessage.setText(e.getMessage());
           return;
       }
       resultMessage.
         }