Hämta och uppdatera presentationsinformation i Python via Java

Översikt

Aspose.Slides kan identifiera ett presentationsformat och läsa dess dokumentmetadata utan att skapa en komplett presentationsobjektmodell. Detta är användbart när du behöver klassificera filer, bygga ett inventarium eller inspektera egenskaper innan du beslutar om du ska läsa in och bearbeta presentationsinnehållet.

Exemplen kräver Aspose.Slides för Python via Java och en kompatibel Java‑runtime. Varje exempel startar JVM:n om den inte redan körs. Tillhandahåll befintliga presentationsfiler på de sökvägar som används i exemplen.

Denna artikel demonstrerar lättviktsinspektion via PresentationFactory och PresentationInfo, samt målmedvetna uppdateringar via DocumentProperties.

Kontrollera ett presentationsformat

Använd PresentationFactory.getPresentationInfo för att inspektera en fil utan att skapa en Presentation-instans. Metoden PresentationInfo.getLoadFormat rapporterar det upptäckta formatet, exempelvis PPTX, PPT eller ODP.

import jpype
import asposeslides

if not jpype.isJVMStarted():
    jpype.startJVM()

from asposeslides.api import LoadFormat, PresentationFactory

file_names = ["pres.pptx", "pres.ppt", "pres.odp"]

for file_name in file_names:
    presentation_info = PresentationFactory.getInstance().getPresentationInfo(file_name)
    load_format = presentation_info.getLoadFormat()
    format_name = f"Other ({load_format})"

    if load_format == LoadFormat.Pptx:
        format_name = "PPTX"
    elif load_format == LoadFormat.Ppt:
        format_name = "PPT"
    elif load_format == LoadFormat.Odp:
        format_name = "ODP"

    print(f"{file_name}: {format_name}")

Bygg ett lättviktigt presentationsinventarium

När du bearbetar många presentationsfiler kan du behöva ett kompakt inventarium för validering, indexering eller ett dokumenthanteringssystem. I detta scenario, använd PresentationFactory.getPresentationInfo för att erhålla ett PresentationInfo-objekt, och anropa sedan PresentationInfo.readDocumentProperties för att läsa dokumentmetadata. Detta tillvägagångssätt skapar inte en Presentation-instans eller kräver att du traverserar hela presentationsobjektmodellen.

De utökade egenskaperna som exponeras av DocumentProperties tillhandahåller följande inventarievärden:

Metod Inventarievärde
getSlides Totalt antal bilder.
getHiddenSlides Antal dolda bilder.
getNotes Antal bilder som innehåller anteckningar.
getParagraphs Totalt antal stycken, när tillgängligt.
getWords Totalt antal ord.
getMultimediaClips Totalt antal ljud‑ och videoklipp.

Följande exempel läser dessa värden utan att skapa ett Presentation-objekt och skriver ut ett kompakt inventarium. Det kombinerar också getHeadingPairs med getTitlesOfParts för att visa innehållsgrupper såsom teckensnitt, teman och bildtitlar.

import jpype
import asposeslides

if not jpype.isJVMStarted():
    jpype.startJVM()

from pathlib import Path
from asposeslides.api import LoadFormat, PresentationFactory

file_path = "sample.pptx"
presentation_info = PresentationFactory.getInstance().getPresentationInfo(file_path)
document_properties = presentation_info.readDocumentProperties()

load_format = presentation_info.getLoadFormat()
format_name = f"Other ({load_format})"

if load_format == LoadFormat.Pptx:
    format_name = "PPTX"
elif load_format == LoadFormat.Ppt:
    format_name = "PPT"
elif load_format == LoadFormat.Odp:
    format_name = "ODP"

print(f"File: {Path(file_path).name}")
print(f"Format: {format_name}")
print(f"Title: {document_properties.getTitle()}")
print(f"Author: {document_properties.getAuthor()}")
print("Statistics:")
print(f"  Slides: {document_properties.getSlides()}")
print(f"  Hidden slides: {document_properties.getHiddenSlides()}")
print(f"  Slides with notes: {document_properties.getNotes()}")
print(f"  Paragraphs: {document_properties.getParagraphs()}")
print(f"  Words: {document_properties.getWords()}")
print(f"  Multimedia clips: {document_properties.getMultimediaClips()}")

heading_pairs = document_properties.getHeadingPairs()
titles_of_parts = document_properties.getTitlesOfParts()
heading_pairs = heading_pairs if heading_pairs is not None else []
titles_of_parts = titles_of_parts if titles_of_parts is not None else []
part_index = 0

if len(heading_pairs) == 0 or len(titles_of_parts) == 0:
    print("Content groups: not available")
else:
    print("Content groups:")

    for heading_pair in heading_pairs:
        print(f"  {heading_pair.getName()} ({heading_pair.getCount()})")

        for part_offset in range(heading_pair.getCount()):
            if part_index >= len(titles_of_parts):
                break
            print(f"    - {titles_of_parts[part_index]}")
            part_index += 1

    if part_index < len(titles_of_parts):
        print("  Other parts:")

        while part_index < len(titles_of_parts):
            print(f"    - {titles_of_parts[part_index]}")
            part_index += 1

Varje HeadingPair tillhandahåller ett gruppnamn och antalet objekt i den gruppen. DocumentProperties.getTitlesOfParts returnerar en platt, ordnad lista, så konsumera antalet på varandra följande titlar som anges av varje rubrikpar.

Lagrad metadata och formatbegränsningar

Inventarieegenskaperna som returneras av PresentationInfo.readDocumentProperties speglar metadata som finns i källdokumentet. Aspose.Slides laddar inte och traverserar inte presentationsobjektmodellen för att omräkna dessa värden för detta anrop. Saknade egenskaper representeras av standardvärden, och lagrade värden kan vara föråldrade om programmet som senast sparade filen inte uppdaterade dess dokumentegenskaper.

  • PPTX: Formatet tillhandahåller utökade dokumentegenskaper för bild, anteckning, dold bild, stycke, ord och multimedia‑räkningar, samt rubrikpar och deltitlar. Tillgängligheten beror på vilka egenskaper som skrevs av dokumentproducenten.
  • PPT: Det binära formatet kan lagra motsvarande dokument‑sammanfattningsegenskaper. Om en egenskap saknas eller inte uppdaterades av dokumentproducenten, returnerar Aspose.Slides dess lagrade eller standardvärde istället för att beräkna det från bilderna.
  • ODP: OpenDocument‑metadata tillhandahåller allmän dokumentstatistik, såsom sid‑, stycke‑ och ordantal, men dessa värden motsvarar inte varje PowerPoint‑specifik utökad egenskap. Metadata för dolda bilder, bildanteckningar, multimedia, rubrikpar och deltitlar kan vara otillgänglig, och inventarieegenskaperna kan returnera standardvärden. Behandla inte ett nollvärde eller en tom array som ett auktoritativt bevis på att motsvarande innehåll saknas.

Använd den lättviktiga metadata‑metoden för inventarier och preliminära kontroller. Läs in presentationen och inspektera dess levande objektmodell när resultatet måste återspegla förändringar i minnet eller när du behöver verifiera det faktiska presentationsinnehållet.

Uppdatera presentationsegenskaper

Egenskaperna som returneras av PresentationInfo.readDocumentProperties kan också ändras utan att skapa en Presentation-instans. Tillämpa förändringarna med PresentationInfo.updateDocumentProperties och skriv sedan den bundna presentationen med PresentationInfo.writeBindedPresentation.

Ursprungliga dokumentegenskaper för PowerPoint‑presentationen

Följande exempel ändrar titeln och den senaste sparningstiden och skriver resultatet till en ny fil:

import jpype
import asposeslides

if not jpype.isJVMStarted():
    jpype.startJVM()

from asposeslides.api import PresentationFactory
from java.io import FileOutputStream
from java.util import Date

source_file = "sample.pptx"
output_file = "sample_with_updated_properties.pptx"
presentation_info = PresentationFactory.getInstance().getPresentationInfo(source_file)
document_properties = presentation_info.readDocumentProperties()

document_properties.setTitle("Quarterly sales report")
last_saved_time = Date()
document_properties.setLastSavedTime(last_saved_time)

presentation_info.updateDocumentProperties(document_properties)
output_stream = FileOutputStream(output_file)
try:
    presentation_info.writeBindedPresentation(output_stream)
finally:
    output_stream.close()

Ändrade dokumentegenskaper för PowerPoint‑presentationen

Användbara länkar

För relaterade säkerhetskontroller och skyddsinställningar, se följande artiklar:

FAQ

Hur kan jag kontrollera om teckensnitt är inbäddade och vilka de är?

Läs in presentationen och använd Presentation.getFontsManager. Anropa FontsManager.getEmbeddedFonts för att hämta de inbäddade teckensnitten och FontsManager.getFonts för att hämta teckensnitten som används av presentationen. Jämför de två resultaten för att hitta teckensnitt som krävs för rendering men som inte är inbäddade.

Hur kan jag snabbt avgöra om filen har dolda bilder och hur många?

När lagrad dokumentmetadata är tillräcklig, läs DocumentProperties.getHiddenSlides via PresentationFactory.getPresentationInfo och PresentationInfo.readDocumentProperties. Detta är lämpligt för ett lättviktigt inventarium. Om presentationen har ändrats i minnet kan den lagrade metadata saknas eller vara föråldrad, eller så behöver du verifiera aktuella värden genom att iterera över Presentation.getSlides och inspektera varje bilds Slide.getHidden-metod istället.

Kan jag upptäcka om en anpassad bildstorlek och orientering används, och om de avviker från standardinställningarna?

Ja. Läs in presentationen och anropa Presentation.getSlideSize. Använd SlideSize.getType, SlideSize.getSize och SlideSize.getOrientation för att jämföra de aktuella inställningarna med den förväntade förinställningen och dimensionerna.

Finns det ett snabbt sätt att se om diagram refererar till externa datakällor?

Ja. Hitta varje Chart och anropa ChartData.getDataSourceType. För en extern arbetsbok, anropa ChartData.getExternalWorkbookPath. Datakälltypen och sökvägen identifierar en extern referens, men att verifiera om målet är tillgängligt kräver en separat resurskontroll.

Hur kan jag bedöma “tunga” bilder som kan sakta ner renderingen eller PDF‑export?

Det finns ingen enskild komplexitetsegenskap. Traversera Presentation.getSlides och varje bilds BaseSlide.getShapes-samling. Använd antalet former samt förekomsten av stora bilder, effekter, animationer eller multimedia som screening‑signaler, och mät en representativ rendering eller export innan du behandlar en bild som en bekräftad prestandaflaskhals.