预测 20T 参数模型将出现不可读推理,凸显机制可解释性价值

scaling01 · x · 2026-08-11

作者预测,当 OpenAI 的模型参数量达到 10T 或 20T 规模时,其思维链(CoT)可能会演变成几乎完全不可读的“神经语言”(neuralese)。

作者指出,随着模型规模扩大,越来越多的推理过程将在内部隐式发生,仅靠监控表面的思维链不仅扩展性受限,还需要额外精力确保其忠实度与可读性。这使得深入模型内部的机制可解释性(mech interp)变得前所未有的重要。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →