以 Python 從 XFA 表單中提取數據

如何使用 Python 從 PDF 中的 XFA 表單提取數據

Aspose.PDF for Python for .NET Logo

如何使用 Aspose.PDF 用於 Python for .NET 工具從 PDF 中的 XFA 表單中提取數據

您是否需要從 PDF 中的 XFA 表單中提取資料?對 PDF 文件進行程序化修改是現代數位工作流程的重要組成部分。透過 Aspose.PDF 等 Python 函式庫,開發人員可以從 PDF 中的 XFA 表單中提取資料。這些函式庫是獨立的解決方案,不依賴其他軟體,並且已準備好用於商業用途。它們涵蓋了專業 Python 開發人員的所有可能需求。

  • 從 PDF 提取文本
  • 從 PDF 提取圖像
  • 從 PDF 提取字體
  • 從表單中提取數據
  • 從圖章中擷取文本
  • 從表格中提取數據

為了從 PDF 檔案中的 XFA 表單中提取數據,我們將使用 Aspose.PDF for .NET API,這是一個功能豐富、強大且易於使用的文件操作 API,適用於 python-net 平台。開啟 NuGet 套件管理器,搜尋 Aspose.PDF 並安裝。您也可以從軟體包管理器控制台使用以下命令。

Console

pip install aspose-pdf

以 Python 從 XFA 表單中提取數據


要在您的環境中嘗試程式碼,您需要 Aspose.PDF for Python

1.定義 XFA 到 ACROFORM 轉換函數。 1.開啟輸入的 PDF 文件。 1.將表單類型轉換為標準 AcroForm。 1.儲存轉換後的 AcroForm PDF。 1.將 AcroForm 資料匯出為 XML。

以 Python 從 XFA 表單中提取數據

此範例代碼顯示如何從 PDF 文檔中的 XFA 表單提取數據

Input file:

File not added

Output format:

PDF

Output file:


import aspose.pdf as ap

with ap.Document(input_pdf) as document:
    # Convert Dynamic XFA to Standard AcroForm
    document.form.type = ap.forms.FormType.STANDARD

    # Save converted AcroForm PDF
    document.save(converted_pdf)

    # Export form data to XML
    document.form.export_xml(xml_output)

關於 Aspose.PDF for Python for .NET API

通过 .NET API for Python 的 Aspose.PDF 支持大多数既定的 PDF 标准和 PDF 规范。它允许开发人员将表格、图表、图像、超链接、自定义字体等插入到 PDF 文档中。此外,还可以压缩 PDF 文档。通过.NET for Python 的 Aspose.PDF 为开发安全的 PDF 文档提供了出色的安全功能。通过 .NET API 实现的 Aspose.PDF for Python 的一些关键功能包括:

  • 能够读取和导出多种图像格式的 PDF,包括 BMP、GIF、JPEG 和 PNG。
  • 设置 PDF 文档的基本信息(例如作者、创建者)。
  • 转换功能:将 PDF 转换为 Word、Excel 和 PowerPoint。将 PDF 转换为图像格式。将 PDF 文件转换为 HTML 格式,反之亦然。将 PDF 转换为 EPUB、文本、XPS 等

关于 API 的使用,你可以在我们的 文档 中通过.NET API 找到有关 Aspose.PDF for Python 的更多信息。