在企业工作流程中,PDF 表单被广泛用于数据采集。用户填写表单后,系统通常需要自动提取字段值,以便进行存储、验证或下游处理。本文演示了如何使用 C# 读取交互式 PDF 表单字段,包括文本框、复选框、单选按钮、列表框和组合框。
1. 方法概述
PDF 中的每个表单字段都有一个唯一的名称、一个类型指示器和一个当前值。整体流程非常直观:
- 加载 PDF 文档。
- 访问表单集合。
- 遍历所有字段。
- 根据每个字段的类型提取其值。
我们将使用 Free Spire.PDF for .NET 库,该库提供了用于表单操作的 PdfFormWidget 类,并支持通过索引或名称查找字段。
2. 前置条件
2.1 安装 NuGet 包
通过 Visual Studio 的 NuGet 包管理器安装 FreeSpire.PDF,或在包管理器控制台中运行以下命令:
Install-Package FreeSpire.PDF
安装完成后,会自动添加对 Spire.Pdf.dll 的引用。请注意,免费版本限制每个文档仅处理前 10 页,但这通常足以满足表单提取的需求。
2.2 导入所需的命名空间
using Spire.Pdf;
using Spire.Pdf.Widget;
using System;
using System.Text;
3. 读取表单字段的基本工作流程
3.1 加载文档并获取表单
PdfDocument doc = new PdfDocument();
doc.LoadFromFile("YourForm.pdf");
// 转换为 PdfFormWidget 以访问完整的字段集合
PdfFormWidget formWidget = doc.Form as PdfFormWidget;
doc.Form 属性返回一个通用表单对象;将其转换为 PdfFormWidget 后,您可以获得完整的字段列表。
3.2 遍历所有字段
for (int i = 0; i < formWidget.FieldsWidget.List.Count; i
免责声明:本文内容来自互联网,该文观点不代表本站观点。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如发现本站有涉嫌抄袭侵权/违法违规的内容,请到页面底部单击反馈,一经查实,本站将立刻删除。
下一篇 :
程序说笼子已锁。我询问了内核。
分享到:
长按或扫码识别 分享给好友