Importar Apresentações de PDF ou HTML em Python via Java
Introdução
Aspose.Slides for Python via Java pode transformar páginas PDF ou conteúdo HTML em slides PowerPoint sem o Microsoft PowerPoint. A classe SlideCollection fornece addFromPdf e addFromHtml para anexar conteúdo importado a uma apresentação.
Para maior controle sobre o posicionamento do HTML, SlideCollection.insertFromHtml pode inserir slides gerados em um índice da coleção ou começar a preencher o espaço disponível em um slide existente. HTML longo é paginado automaticamente em slides adicionais, a fonte pode ser fornecida como string ou stream, e recursos externos podem ser carregados através de ExternalResourceResolver com uma URI base. O array de Slide retornado identifica os slides afetados e os recém‑criados.
Importação de PDF
Para converter um documento PDF em uma apresentação PowerPoint, importe seu conteúdo na coleção de slides e salve o resultado como um arquivo PPTX.

- Crie um novo objeto Presentation.
- Chame addFromPdf com o caminho para o arquivo PDF.
- Chame save com SaveFormat.Pptx para gravar a apresentação em um arquivo PPTX.
O exemplo Python a seguir importa um documento PDF e salva os slides gerados como uma apresentação PowerPoint:
import jpype
import asposeslides
if not jpype.isJVMStarted():
jpype.startJVM()
from asposeslides.api import Presentation, SaveFormat
presentation = Presentation()
try:
presentation.getSlides().addFromPdf("document.pdf")
presentation.save("presentation.pptx", SaveFormat.Pptx)
finally:
presentation.dispose()
O slide em branco padrão permanece na apresentação porque a importação acrescenta slides. Para manter somente as páginas importadas, limpe a coleção de slides com SlideCollection.clear antes de importar.
O método addFromPdf retorna os slides que ele adiciona, o que é útil quando você precisa processar apenas os slides importados.
Dica
Experimente o aplicativo web gratuito PDF to PowerPoint para ver esse fluxo de conversão em ação.Importação de HTML
Aspose.Slides também pode criar slides a partir de um documento HTML. A fonte pode ser fornecida como texto HTML ou como stream. Os passos a seguir utilizam um stream de arquivo:
- Crie um novo objeto Presentation.
- Abra o arquivo HTML para leitura e passe o stream para addFromHtml.
- Chame save com SaveFormat.Pptx para gravar o resultado em um arquivo PPTX.
O exemplo Python a seguir importa um documento HTML e salva os slides gerados como uma apresentação PowerPoint:
import jpype
import asposeslides
if not jpype.isJVMStarted():
jpype.startJVM()
from asposeslides.api import Presentation, SaveFormat
from java.io import FileInputStream
presentation = Presentation()
try:
html_stream = FileInputStream("page.html")
try:
presentation.getSlides().addFromHtml(html_stream)
finally:
html_stream.close()
presentation.save("presentation.pptx", SaveFormat.Pptx)
finally:
presentation.dispose()
Inserir Conteúdo HTML
Use SlideCollection.insertFromHtml quando slides gerados a partir de HTML precisarem ser posicionados em um ponto específico em vez de serem anexados. O índice é baseado em zero e identifica a posição onde a importação começa.
O argumento useSlideWithIndexAsStart controla como o importador usa essa posição:
- Quando for
False, o importador cria novos slides no índice especificado e desloca os slides que os seguem. - Quando for
True, o importador começa a colocar o conteúdo no espaço disponível do slide existente naquele índice. Se o HTML não couber, Aspose.Slides o pagina automaticamente e insere slides adicionais imediatamente após o slide inicial.
SlideCollection.insertFromHtml retorna um array de objetos Slide. Quando a inserção inicia em novos slides, cada item retornado é recém‑criado. Quando um slide existente é usado como ponto de partida, o array inclui esse slide afetado seguido por quaisquer novos slides de transbordamento. Você pode inspecionar esse array em vez de calcular o intervalo afetado a partir da contagem de slides da apresentação.
Inserir HTML como Novos Slides
O exemplo a seguir fornece HTML como string e insere os slides gerados no índice da coleção 1. Passar False deixa os slides existentes inalterados, apenas deslocando‑os para abrir espaço.
import jpype
import asposeslides
if not jpype.isJVMStarted():
jpype.startJVM()
from asposeslides.api import Presentation, SaveFormat
presentation = Presentation()
try:
layout_slide = presentation.getLayoutSlides().get_Item(0)
presentation.getSlides().addEmptySlide(layout_slide)
presentation.getSlides().addEmptySlide(layout_slide)
insert_index = 1
html = "<html><body><h1>Quarterly update</h1><p>This content is inserted before the slide that was at index 1.</p></body></html>"
inserted_slides = presentation.getSlides().insertFromHtml(insert_index, html, False)
for slide in inserted_slides:
print("Inserted slide index:", presentation.getSlides().indexOf(slide))
presentation.save("presentation-with-inserted-html.pptx", SaveFormat.Pptx)
finally:
presentation.dispose()
Iniciar em um Slide Existente
O próximo exemplo fornece o HTML através de um stream. Ele preserva uma forma de cabeçalho no slide de modelo existente, inicia a importação abaixo da área ocupada e permite que o corpo longo continue em novos slides.
O HTML também contém uma URL de imagem relativa. Um ExternalResourceResolver obtém o recurso, enquanto a URI base informa ao importador como resolver images/logo.png. Neste exemplo, espera‑se que esse arquivo esteja em html-assets/images/logo.png.
from pathlib import Path
import jpype
import asposeslides
if not jpype.isJVMStarted():
jpype.startJVM()
from asposeslides.api import ExternalResourceResolver, Presentation, SaveFormat, ShapeType
from java.io import ByteArrayInputStream
presentation = Presentation()
try:
template_slide = presentation.getSlides().get_Item(0)
header = template_slide.getShapes().addAutoShape(ShapeType.Rectangle, 20, 20, 680, 60)
header.getTextFrame().setText("Product roadmap")
html_parts = ["<html><body><img src='images/logo.png' width='120' height='60'><h2>Roadmap details</h2>"]
for item_index in range(1, 61):
html_parts.append(f"<p style='font-size:24pt'>Roadmap item {item_index}: detailed implementation notes.</p>")
html_parts.append("</body></html>")
html = "".join(html_parts)
html_data = html.encode("utf-8")
resolver = ExternalResourceResolver()
base_directory = Path("html-assets").resolve()
base_uri = base_directory.as_uri() + "/"
html_stream = ByteArrayInputStream(html_data)
try:
affected_slides = presentation.getSlides().insertFromHtml(0, html_stream, resolver, base_uri, True)
for slide in affected_slides:
print("Affected slide index:", presentation.getSlides().indexOf(slide))
finally:
html_stream.close()
presentation.save("presentation-with-html-overflow.pptx", SaveFormat.Pptx)
finally:
presentation.dispose()
Aviso
Um resolvedor de recursos externos sem restrições pode ler recursos locais ou de rede referenciados pelo HTML. Para entrada não confiável, valide e saneie URLs de recursos contra uma lista de permissões de esquemas, diretórios e hosts antes de importar o HTML.FAQ
A Aspose.Slides pode detectar tabelas ao importar um PDF?
Sim. Crie um objeto PdfImportOptions, chame setDetectTables com True e passe as opções para addFromPdf. A qualidade do reconhecimento de tabelas depende da estrutura e complexidade do PDF de origem.