实测发现:模型猜自己的能力参数总是系统性偏低

repligate · x · 2026-10-08

Anthropic 成员 repligate 转推的一则观察:网友数月前与 Opus 4.6 对话时,让模型猜测自身规格,它猜自己只有 250k 上下文窗口,看到自己的真实 benchmark 成绩后「明显震惊」。

此后该网友养成了让模型自估能力的习惯,结论是:模型的自估总是朝偏弱的方向出错,连最新的 Fables 模型也不例外。这类「模型不知道自己有多强」的自我建模盲区,对设计 agent 的自我规划与委派策略有参考意义。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →