Извлечение шрифтов из PDF с помощью Python

Contents
[ ]

Используйте Document, чтобы открыть PDF, и вызовите font_utilities.get_all_fonts(), чтобы получить все объекты Font, на которые ссылается документ. Это полезно при аудите встроенных шрифтов, проверке доступности шрифтов перед конвертацией или анализе ресурсов документа.

  1. Откройте исходный PDF как Document.
  2. Вызовите document.font_utilities.get_all_fonts(), чтобы получить коллекцию шрифтов.
  3. Переберите возвращённые объекты Font.
  4. Прочитайте и выведите каждое значение font.font_name.

    import aspose.pdf as apdf
    from os import path

    path_infile = path.join(self.dataDir, infile)

    # Open PDF document
    document = apdf.Document(path_infile)

    fonts = document.font_utilities.get_all_fonts()
    for font in fonts:
        print(font.font_name)