تحويل PDF إلى HTML في Java

يدعم Aspose.PDF for Java تصدير HTML مع خيارات للصور، وSVG، وتقسيم الصفحات، والشفافية، وعرض الطبقات. استخدم HtmlSaveOptions للتحكم في كيفية كتابة صفحات PDF والموارد والترميز إلى إخراج HTML.

تحويل PDF إلى HTML

استخدم هذا المثال عندما يجب تصدير ملف PDF إلى مستند HTML قياسي.

  1. افتح ملف PDF المصدر في مثيل Document.
  2. أنشئ الإعداد الافتراضي HtmlSaveOptions للتسلسل القياسي لـ HTML..
  3. استدعِ document.save(outputFile.toString(), saveOptions) لذا يتم تصدير محتوى صفحة PDF كعلامات HTML..
  4. احفظ مخرجات HTML التي تم إنشاؤها.
public static void convertPdfToHtml(Path inputFile, Path outputFile) {
    try (Document document = new Document(inputFile.toString())) {
        HtmlSaveOptions saveOptions = new HtmlSaveOptions();
        document.save(outputFile.toString(), saveOptions);
    }
    System.out.println(inputFile + " converted into " + outputFile);
}

تحويل PDF إلى HTML وتخزين الصور بشكل منفصل

استخدم هذا المثال عندما يجب كتابة الصور المستخرجة كملفات منفصلة أثناء تصدير HTML.

  1. افتح ملف PDF المصدر في مثيل Document.
  2. أنشئ كائنًا من الفئة HtmlSaveOptions وضع setSpecialFolderForAllImages(...) إلى دليل إخراج صور مخصص.
  3. استدعِ document.save(outputFile.toString(), saveOptions) لذا يتم إصدار صور النقطية كملفات موارد منفصلة بدلاً من الإخراج داخل السطر فقط.
  4. احفظ مخرجات HTML إلى جانب الأصول المتولدة للصور.
public static void convertPdfToHtmlStoringImages(Path inputFile, Path outputFile) {
    try (Document document = new Document(inputFile.toString())) {
        HtmlSaveOptions saveOptions = new HtmlSaveOptions();
        saveOptions.setSpecialFolderForAllImages(inputFile.getParent().resolve("images").toString());
        document.save(outputFile.toString(), saveOptions);
    }
    System.out.println(inputFile + " converted into " + outputFile);
}

تحويل PDF إلى HTML متعدد الصفحات

استخدم هذا المثال عندما يجب تمثيل كل صفحة PDF بشكل منفصل في مخرجات HTML.

  1. افتح ملف PDF المصدر في مثيل Document.
  2. أنشئ كائنًا من الفئة HtmlSaveOptions وفعّل setSplitIntoPages(true).
  3. استدعِ document.save(outputFile.toString(), saveOptions) لذلك يتم كتابة كل صفحة PDF كمخرج HTML منفصل.
  4. احفظ ملفات HTML التي تم إنشاؤها.
public static void convertPdfToHtmlMultiPage(Path inputFile, Path outputFile) {
    try (Document document = new Document(inputFile.toString())) {
        HtmlSaveOptions saveOptions = new HtmlSaveOptions();
        saveOptions.setSplitIntoPages(true);
        document.save(outputFile.toString(), saveOptions);
    }
    System.out.println(inputFile + " converted into " + outputFile);
}

تحويل PDF إلى HTML وتخزين SVG بشكل منفصل

استخدم هذا المثال عندما يجب إصدار محتوى المتجهات كموارد SVG منفصلة.

  1. افتح ملف PDF المصدر في مثيل Document.
  2. أنشئ كائنًا من الفئة HtmlSaveOptions وضع setSpecialFolderForSvgImages(...) إلى دليل موارد SVG خارجي.
  3. استدعِ document.save(outputFile.toString(), saveOptions) لذا تُخزن الرسومات المتجهية خارج ملف HTML الرئيسي.
  4. احفظ مخرجات HTML وأصول SVG.
public static void convertPdfToHtmlStoringSvg(Path inputFile, Path outputFile) {
    try (Document document = new Document(inputFile.toString())) {
        HtmlSaveOptions saveOptions = new HtmlSaveOptions();
        saveOptions.setSpecialFolderForSvgImages(inputFile.getParent().resolve("svg_images").toString());
        document.save(outputFile.toString(), saveOptions);
    }
    System.out.println(inputFile + " converted into " + outputFile);
}

تحويل PDF إلى HTML مع SVG مضغوط

استخدم هذا المثال عندما يجب تحسين إخراج SVG أثناء تصدير HTML.

  1. افتح ملف PDF المصدر في مثيل Document.
  2. أنشئ كائنًا من الفئة HtmlSaveOptions وتهيئة مجلد مخصص لموارد SVG..
  3. فعّل setCompressSvgGraphicsIfAny(true) لذلك يتم ضغط ملفات SVG أثناء التصدير.
  4. استدعِ document.save(outputFile.toString(), saveOptions) واحفظ ملفات HTML المحوَّلة.
public static void convertPdfToHtmlCompressSvg(Path inputFile, Path outputFile) {
    try (Document document = new Document(inputFile.toString())) {
        HtmlSaveOptions saveOptions = new HtmlSaveOptions();
        saveOptions.setSpecialFolderForSvgImages(inputFile.getParent().resolve("svg_images").toString());
        saveOptions.setCompressSvgGraphicsIfAny(true);
        document.save(outputFile.toString(), saveOptions);
    }
    System.out.println(inputFile + " converted into " + outputFile);
}

تحويل PDF إلى HTML مع خلفيات صفحات PNG

استخدم هذا المثال عندما يجب عرض خلفيات الصفحات كصور PNG في مخرجات HTML.

  1. افتح ملف PDF المصدر في مثيل Document.
  2. أنشئ كائنًا من الفئة HtmlSaveOptions وعيّن وضع حفظ الصورة النقطية إلى خلفيات الصفحات بصيغة PNG..
  3. استدعِ document.save(outputFile.toString(), saveOptions) لذلك يتم إصدار محتوى خلفية الصفحة كطبقات HTML مدعومة بـ PNG..
  4. احفظ مخرجات HTML المحولة.
public static void convertPdfToHtmlPngBackground(Path inputFile, Path outputFile) {
    try (Document document = new Document(inputFile.toString())) {
        HtmlSaveOptions saveOptions = new HtmlSaveOptions();
        saveOptions.setRasterImagesSavingMode(
                HtmlSaveOptions.RasterImagesSavingModes.AsEmbeddedPartsOfPngPageBackground);
        document.save(outputFile.toString(), saveOptions);
    }
    System.out.println(inputFile + " converted into " + outputFile);
}

تحويل PDF إلى محتوى جسم HTML فقط

استخدم هذا المثال عندما تكون الحاجة فقط إلى ترميز الجسم بدلاً من هيكل مستند HTML كامل.

  1. افتح ملف PDF المصدر في مثيل Document.
  2. أنشئ كائنًا من الفئة HtmlSaveOptions واضبط وضع إنشاء العلامات إلى WriteOnlyBodyContent.
  3. احتفظ setSplitIntoPages(true) مفعَّل عندما يجب أن يظل الإخراج الذي يقتصر على النص مفصولًا إلى صفحات.
  4. استدعِ document.save(outputFile.toString(), saveOptions) واحفظ مخرجات HTML..
public static void convertPdfToHtmlBodyContent(Path inputFile, Path outputFile) {
    try (Document document = new Document(inputFile.toString())) {
        HtmlSaveOptions saveOptions = new HtmlSaveOptions();
        saveOptions.setHtmlMarkupGenerationMode(
                HtmlSaveOptions.HtmlMarkupGenerationModes.WriteOnlyBodyContent);
        saveOptions.setSplitIntoPages(true);
        document.save(outputFile.toString(), saveOptions);
    }
    System.out.println(inputFile + " converted into " + outputFile);
}

تحويل PDF إلى HTML مع عرض النص الشفاف

استخدم هذا المثال عندما يجب الحفاظ على النص الشفاف في تصدير HTML.

  1. افتح ملف PDF المصدر في مثيل Document.
  2. أنشئ كائنًا من الفئة HtmlSaveOptions وفعّل حفظ النص الشفاف والمظلل.
  3. استدعِ document.save(outputFile.toString(), saveOptions) لذلك يتم الاحتفاظ بمظهر النص المتعلق بالشفافية في نتيجة HTML..
  4. احفظ مخرجات HTML المحولة.
public static void convertPdfToHtmlTransparentTextRendering(Path inputFile, Path outputFile) {
    try (Document document = new Document(inputFile.toString())) {
        HtmlSaveOptions saveOptions = new HtmlSaveOptions();
        saveOptions.setSaveTransparentTexts(true);
        saveOptions.setSaveShadowedTextsAsTransparentTexts(true);
        document.save(outputFile.toString(), saveOptions);
    }
    System.out.println(inputFile + " converted into " + outputFile);
}

تحويل PDF إلى HTML مع عرض طبقة المستند

استخدم هذا المثال عندما يجب عكس رؤية طبقة PDF في نتيجة HTML.

  1. افتح ملف PDF المصدر في مثيل Document.
  2. أنشئ كائنًا من الفئة HtmlSaveOptions وفعّل setConvertMarkedContentToLayers(true).
  3. استدعِ document.save(outputFile.toString(), saveOptions) يتم تعيين محتوى PDF المحدد إلى طبقات HTML..
  4. احفظ ملفات HTML المصدرة.
public static void convertPdfToHtmlDocumentLayersRendering(Path inputFile, Path outputFile) {
    try (Document document = new Document(inputFile.toString())) {
        HtmlSaveOptions saveOptions = new HtmlSaveOptions();
        saveOptions.setConvertMarkedContentToLayers(true);
        document.save(outputFile.toString(), saveOptions);
    }
    System.out.println(inputFile + " converted into " + outputFile);
}