连测三天 GPT-6 Astra:过拟合明显,复杂编码仍需大量引导

ivan_bezdomny · x · 2026-09-08

作者汇总信息并亲自测了三天 Astra,泼冷水:

背景:Astra 刷爆 ARC-AGI-3 等榜单,黄仁勋称之为 AGI。不少用户表示要退回 Fable。结论:榜单成绩与真实编码体验有明显落差。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →