开发者实测:Astra 自信满满却全错,改动致性能回归

cnakazawa · x · 2026-09-05

开发者 cnakazawa 分享对新模型 Astra 的一次实测结果:模型对自己的判断表现得很自信,但结论完全错误——它提议的改动不仅没有带来有意义的性能提升,反而造成了性能回退。作者以「Phew(还好)」的口吻收尾,暗示幸好只是虚惊,但也暴露了新模型在工程场景中「自信但不可靠」的问题。

原文链接 →

「Fun」频道最新

更多「Fun」频道 AI 资讯 →