Convertir PDF a Word en Java

Aspose.PDF for Java puede exportar documentos PDF a formatos de Microsoft Word con diferentes opciones de reconocimiento y diseño. Use DocSaveOptions para controlar cómo se mapean el texto, las listas y las imágenes del PDF en la salida de Word.

Convertir PDF a DOC

Utilice este ejemplo cuando un documento PDF debe exportarse al formato DOC heredado. El código crea DocSaveOptions, establece el formato a Doc, y pasa las opciones a un método de guardado compartido.

  1. Abra el PDF de origen en una instancia de Document.
  2. Cree DocSaveOptions y establezca el formato a Doc.
  3. Llame document.save(outputFile.toString(), saveOptions) por lo que el PDF se exporta al formato binario de documento de Microsoft Word.
  4. Guarde el archivo DOC convertido.
public static void convertPdfToDoc(Path inputFile, Path outputFile) {
    try (Document document = new Document(inputFile.toString())) {
        DocSaveOptions saveOptions = new DocSaveOptions();
        saveOptions.setFormat(DocSaveOptions.DocFormat.Doc);
        document.save(outputFile.toString(), saveOptions);
    }
    System.out.println(inputFile + " converted into " + outputFile);
}

Convertir PDF a DOCX

Use este ejemplo cuando un documento PDF deba exportarse como un archivo DOCX. DOCX es el formato preferido para la mayoría de los flujos de trabajo de procesamiento de texto nuevos porque está ampliamente soportado y es más fácil de editar.

  1. Abra el PDF de origen en una instancia de Document.
  2. Cree DocSaveOptions y establezca el formato a DocX.
  3. Llame document.save(outputFile.toString(), saveOptions) por lo que el contenido del PDF se exporta como un documento Word de Office Open XML.
  4. Guarde el archivo DOCX resultante.
public static void convertPdfToDocx(Path inputFile, Path outputFile) {
    try (Document document = new Document(inputFile.toString())) {
        DocSaveOptions saveOptions = new DocSaveOptions();
        saveOptions.setFormat(DocSaveOptions.DocFormat.DocX);
        document.save(outputFile.toString(), saveOptions);
    }
    System.out.println(inputFile + " converted into " + outputFile);
}

Convertir PDF a DOCX con reconocimiento de flujo mejorado

Utilice este ejemplo cuando la exportación a Word deba favorecer contenido editable fluido en lugar de un diseño visual fijo.

  1. Abra el PDF de origen en una instancia de Document.
  2. Cree DocSaveOptions para DocX salida.
  3. Habilite setMode(DocSaveOptions.RecognitionMode.EnhancedFlow) por lo tanto, el convertidor utiliza reconocimiento de flujo mejorado durante la generación de DOCX.
  4. Llame document.save(outputFile.toString(), saveOptions) y guarde la salida DOCX convertida.
public static void convertPdfToDocxAdvanced(Path inputFile, Path outputFile) {
    try (Document document = new Document(inputFile.toString())) {
        DocSaveOptions saveOptions = new DocSaveOptions();
        saveOptions.setFormat(DocSaveOptions.DocFormat.DocX);
        saveOptions.setMode(DocSaveOptions.RecognitionMode.EnhancedFlow);
        document.save(outputFile.toString(), saveOptions);
    }
    System.out.println(inputFile + " converted into " + outputFile);
}

Convertir PDF a DOCX con saltos de línea preservados

Utilice este ejemplo cuando los retornos de línea del PDF de origen deben conservarse en la salida de Word.

  1. Abra el PDF de origen en una instancia de Document.
  2. Cree DocSaveOptions para DocX exportar.
  3. Habilite setAddReturnToLineEnd(true) para que los saltos de línea explícitos se conserven durante la conversión.
  4. Llame document.save(outputFile.toString(), saveOptions) y guarde el archivo DOCX.
public static void convertPdfToDocxWithLineBreaks(Path inputFile, Path outputFile) {
    try (Document document = new Document(inputFile.toString())) {
        DocSaveOptions saveOptions = new DocSaveOptions();
        saveOptions.setFormat(DocSaveOptions.DocFormat.DocX);
        saveOptions.setAddReturnToLineEnd(true);
        document.save(outputFile.toString(), saveOptions);
    }
    System.out.println(inputFile + " converted into " + outputFile);
}

Convertir PDF a DOCX con reconocimiento de viñetas

Utilice este ejemplo cuando las viñetas de lista del PDF de origen deban reconocerse y preservarse como estructuras de lista en Word.

  1. Abra el PDF de origen en una instancia de Document.
  2. Cree DocSaveOptions para DocX exportar.
  3. Habilite setRecognizeBullets(true) por lo que el contenido similar a listas en PDF se reconoce como listas con viñetas durante la conversión.
  4. Llame document.save(outputFile.toString(), saveOptions) y guarde el archivo DOCX.
public static void convertPdfToDocxWithBulletRecognition(Path inputFile, Path outputFile) {
    try (Document document = new Document(inputFile.toString())) {
        DocSaveOptions saveOptions = new DocSaveOptions();
        saveOptions.setFormat(DocSaveOptions.DocFormat.DocX);
        saveOptions.setRecognizeBullets(true);
        document.save(outputFile.toString(), saveOptions);
    }
    System.out.println(inputFile + " converted into " + outputFile);
}

Convertir PDF a DOCX con resolución de imagen personalizada

Utilice este ejemplo cuando la fidelidad de la imagen dentro del DOCX generado deba controlarse durante la conversión.

  1. Abra el PDF de origen en una instancia de Document.
  2. Cree DocSaveOptions para DocX exportar.
  3. Establezca setImageResolutionX(300) y setImageResolutionY(300) por lo tanto, el contenido raster se genera a la resolución solicitada.
  4. Llame document.save(outputFile.toString(), saveOptions) y guarde la salida DOCX.
public static void convertPdfToDocxWithImageResolution(Path inputFile, Path outputFile) {
    try (Document document = new Document(inputFile.toString())) {
        DocSaveOptions saveOptions = new DocSaveOptions();
        saveOptions.setFormat(DocSaveOptions.DocFormat.DocX);
        saveOptions.setImageResolutionX(300);
        saveOptions.setImageResolutionY(300);
        document.save(outputFile.toString(), saveOptions);
    }
    System.out.println(inputFile + " converted into " + outputFile);
}