意外的发现:PDF 也能自动化吗?
上周在 Windows 环境中连接谷歌表格和 Claude Code 来整理买家资料时,我不小心把 PDF 文件路径放进了脚本里。我当然以为会失败。
但 Claude Code 读取了 PDF。
「合约中『付款条件』是 30 天内,『运输条件』是 CIF」
准确无误。它甚至自动填入了谷歌表格。
自动化的陷阱:读取不等于理解
前 3 到 4 份合约完美无缺。梦幻队的仓鼠和小狗庆祝了成功案例。但第 5 个文件出现了裂缝。
原始合约:「最低订购量 500 件」
Claude Code 提取值:「最低订购量:50 件」
它读错了数字。少了一个零。之后还发现了更多问题。
• 当 PDF 是扫描本(影像)时,准确率下降到 50% 以下
• 将签名区域误分类为「重要条款」
• 在多语言混合合约中,选择性地忽略特定语言
非开发者的错误:过度自信
「Claude Code 做的所以是对的」这种心态很危险。前 3 到 4 次只是运气好而已。实际上需要以下步骤。
• 提取值验证步骤(非自动,而是手动确认)
• 仅选择高信度合约自动处理
• 金额、数量等「致命错误」设定单独警报
在 Mac Mini 和 Windows 设备上测试的结果,环境差异几乎不存在。问题不在工具,而在流程。
那现在呢?
我仍在继续使用 Claude Code 的 PDF 处理。但现在的用法不同。
自动化领域:标准化表单、检查清单格式的确认项目
手动领域:金额、数量、日期等数据验证
这种平衡到目前为止最稳定。这是曾梦想完全自动化的非开发者的小领悟。