表单类 PDF 的价值都压在填写结果上,可文件一旦归档或转交,数据就被锁在版式里面。想知道某个字段填了什么,只能打开阅读器逐个复制;字段一多,人工誊抄既慢又容易看错。要拿这些值去做校验、入库或者跟单,前提是程序能先把它们读出来。 本文用 Spire.PDF for JavaScript 从已有 PDF 中提取表单域的值:遍历字段集合,逐个判断字段类型,再按类型读出文本框、列表框、下拉框、单选按钮与复选框各自的当前取值。Spire.PDF for JavaScript 基于 WebAssembly 在浏览器端打开并解析文档,读取全程在本地完成,通过虚拟文件系统(VFS)读写文件,不需要后端配合。 本文介绍一个核心功能点: 提取所有表单域的值 有关安装和项目配置,请参考 React 项目中集成 Spire.PDF for JavaScript。以下示例默认已安装 Spire.PDF 并完成 WebAssembly 模块初始化。 提取所有表单域的值 Spire.PDF for JavaScript 提供 PdfFormWidget,用于接管文档里已有的表单域;FieldsWidget 就是它的字段集合,可以按下标逐个取出。各类字段的取值属性并不统一:文本框在 Text 上,复选框要看…