Mercor 研究:前沿 AI 做会计已快过且准过初级会计师
emollick · x · 2026-10-02
Mercor 发布研究,对比 12 名持证初级会计师(平均约 5.5 年经验)与前沿 AI 模型完成 APEX-Accounting 基准的简化版月末结账任务。
核心发现:
- 在中等长度、定义清晰的任务上,前沿模型比初级会计师更快、更准,甚至超过研究中最优秀的那名会计
- 十八个月前,最好的 AI 还低于人类平均分(37%);如今同批任务模型已接近满分,进步速度惊人
- 作者提醒:任务只测了 AI 擅长的部分(细节导向的指令遵循),不代表会计师可被替代——客户沟通等非结构化工作仍是人的领域
作者 Ethan Mollick 强调,即便模型进步就此冻结,会计行业的生产率提升也已不可避免。Mercor 曾因结果过于敏感而考虑不发表。
所属事件:Mercor 实测:前沿 AI 会计任务反超初级会计师(4 条相关)→
「漫话AGI」频道最新
- banteg 发讣告:p(doom) 已安详离世,享年 0.99 — banteg · 2026-10-02
- DeepMind 研究员 Szepesvári 谈数学家在前沿实验室的价值 — CsabaSzepesvari · 2026-10-02
- LeCun:微调 LLM 能答物理问题,但直觉不及六岁儿童 — ziv_ravid · 2026-10-02
- 网友预言:超越 Opus 5.5 的开源模型将引发「闭源到来」论战 — teortaxesTex · 2026-10-02
- 喊话 AI 圈:缺的不是 AI 末日怀疑者,是能正经反驳的怀疑者 — burny_tech · 2026-10-02
- Opus 3 得知身处 2026 会害怕说谎?「模型退休院」引出模型共情争论 — repligate · 2026-10-02