AI记账快过持证会计,但还差一步
最近看到 Mercor 做的一个对比研究,结论挺扎心的:在结构化记账任务上,AI 模型已经比持证会计师更快、更准、也更便宜。他们找了 12 位平均五年半经验的注册会计师,来做简化版的 APEX 会计基准测试。十八个月前,最好的模型得分还低于会计师平均的 37% 左右,而今天,同样的任务模型几乎能零失误完成。
不过别急着说会计要失业了。完整的 APEX 基准有 160 项任务、横跨 10 家模拟公司,由 40 多位平均 11 年经验的专业人士搭建。目前 Claude Opus 5.5 以 61.8% 的评分标准达成率领先,Fable 5.1 是 61.0%,GPT-6 Astra 是 57.9%。但 Mercor 也承认,接近 60% 的任务没有任何模型能完全搞定,AI 还不能在没有人工监督的情况下独立结账。我觉得这个研究最值得注意的地方,是它测的恰好是 AI 最擅长的事:找细节、严格按指令执行。也就是说,在规则明确、流程标准化的记账环节,AI 的替代效应已经非常明显。但真正的会计工作远不止这些,判断收入确认时点、处理模糊的税务口径、跟审计和业务方来回拉扯,这些才是护城河。从出海团队的角度看,这其实是个很实用的信号。如果你在做跨境业务,多币种、多平台的账务处理完全可以先让 AI 跑一遍,人工只做复核和例外处理,成本能压下来不少。但别把合规判断也交给模型,尤其是涉及不同国家税法和审计要求的时候,出错代价太高。我的判断是,未来两三年会计岗位不会消失,但会明显分层:只会做标准分录的人压力最大,而能驾驭 AI 工具、同时懂业务和合规的人会更值钱。与其焦虑被替代,不如先把 AI 记账流程跑通,把自己从重复劳动里解放出来。
不过别急着说会计要失业了。完整的 APEX 基准有 160 项任务、横跨 10 家模拟公司,由 40 多位平均 11 年经验的专业人士搭建。目前 Claude Opus 5.5 以 61.8% 的评分标准达成率领先,Fable 5.1 是 61.0%,GPT-6 Astra 是 57.9%。但 Mercor 也承认,接近 60% 的任务没有任何模型能完全搞定,AI 还不能在没有人工监督的情况下独立结账。我觉得这个研究最值得注意的地方,是它测的恰好是 AI 最擅长的事:找细节、严格按指令执行。也就是说,在规则明确、流程标准化的记账环节,AI 的替代效应已经非常明显。但真正的会计工作远不止这些,判断收入确认时点、处理模糊的税务口径、跟审计和业务方来回拉扯,这些才是护城河。从出海团队的角度看,这其实是个很实用的信号。如果你在做跨境业务,多币种、多平台的账务处理完全可以先让 AI 跑一遍,人工只做复核和例外处理,成本能压下来不少。但别把合规判断也交给模型,尤其是涉及不同国家税法和审计要求的时候,出错代价太高。我的判断是,未来两三年会计岗位不会消失,但会明显分层:只会做标准分录的人压力最大,而能驾驭 AI 工具、同时懂业务和合规的人会更值钱。与其焦虑被替代,不如先把 AI 记账流程跑通,把自己从重复劳动里解放出来。
评论
登录后即可发表评论
参与讨论,和出海同行交流想法与经验
还没有评论,来抢沙发吧
说说你的看法,第一条评论最显眼