Claude Code 的「语言混淆」事件
上周,Windows 设备上的邮件自动化机器人发出了异常信号。来自中国买家的电邮被标记为「英文」,而来自韩国客户的韩文信息则被分类为「其他」。
起初,我们以为 Claude Code 的语言检测模型不够强大。但深入检查数据后,问题出在别的地方。
真凶是「编码」
非开发者团队手动检查了原始邮件文本,发现部分邮件并非以 UTF-8 格式储存,而是采用其他编码方式。当机器人读取损坏的文本时,当然无法识别语言。
原始邮件: 你好 (中文)
机器人收到的: ä½ å¥½ (损坏的文本)
结果: 被分类为「语言不明」
修正及新发现
我们在 Claude Code 提示中增加了一行。当邮件数据进入时,自动进行编码标准化的逻辑。
令人惊讶的是,修正后准确率提升至 98%。更重要的是,之前被「误分类」的邮件中,发现了大量真正有问题的订单请求。
机器人的错误反而揭露了隐藏的数据问题。
结论:自动化是一个学习过程
由非开发者运营的小型团队的自动化不必从一开始就完美。追踪错误、发现规律,一行修正就能改变整个流程。
有了 Claude Code,即使没有技术背景也完全可能做到。