为何前沿实验室狂追千禧年数学题,却不管你的生产代码库

BaconShadow · reddit · 2026-10-01

作者批评 Anthropic、OpenAI 等前沿实验室把每次模型发布都包装成 AGI 逼近:因为抽象数学证明和绿地代码生成容易出 PR 头条,而真实软件工程——技术债、混乱的人类协作上下文、长期架构漂移——才是真正考验通用能力的地方,且没有自动化验证器可以打分。

核心论点:

作者结论:在 AI 能自主递归自我改进并承担自己代码三年后果之前,所有发布都只是裹着营销噪音的增量产品更新。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →