GLM 5.2 记账准度媲美人类会计师
GLM 5.2 is nearly as accurate as a human book keeper
我们实测了开源模型 GLM 5.2 处理英国中小企业季度增值税申报的能力。结果令人震惊:它仅花费 2.73 美元,耗时 68 分钟就处理了 59 笔交易,最终申报金额与人类会计师的基准结果仅相差 7 便士。虽然模型在“创始人股份”的会计分类上犯了有法律风险的错误,且偶尔混淆“零税率”与“免税”概念,但其整体表现已接近专业水平。这项测试证明,AI 在合规性任务上的成本仅为传统外包服务的不到 1%,未来可能彻底颠覆会计行业。
在我们的测试中,GLM 5.2 能够为英国中小企业准备近乎完美的季度增值税申报表,处理 59 笔交易仅需 68 分钟,原始 Token 成本仅为 2.73 美元。
- 资深会计师指出会计并非确定性计算,而是充满主观估计和职业判断的领域,AI 难以处理规则之外的例外情况及复杂的上下文语境。
- 有评论者反驳'近乎完美'的提法,强调税务申报容错率为零,即便 99.99% 的准确率也可能导致罚款甚至刑事责任,而现实中人类错误往往被 IRS 宽容处理。
- 从业者认为 AI 在数据提取等基础任务上能提升效率,但无法替代人类在发票与采购单不匹配等异常场景下的决策权和经验判断。
- 部分用户质疑将企业账目完全交给 LLM 的风险,指出即使是 Intuit 等老牌软件也不允许 AI 完全取代人工审核,以防出现幻觉导致的借贷错误。