GPT-5.6-sol的弱项在行为层面

IndraVahan · x · 2026-07-13

作者在 kindbench 上测试 GPT-5.6-sol 后得出两点观察:

作者进一步认为,我们正快速接近一个阶段:模型“行为”比单纯“智力”更重要;同时提到 fable(6 月 10 日)仍然稳居榜首。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →