输出导向训练可能让模型推理更难被人读懂

GregKamradt · x · 2026-08-04

作者认为,随着业界越来越只看 输出结果,而不再强调代码、基准、工具调用等可审查中间产物,模型的 CoT(思维链)和推理理由 就会失去保持“可读性”的动力。

换句话说,模型未来可能会把推理过程优化成更利于性能、但 更难让人类理解 的形式。被引用的回复进一步把这个担忧推向极端:模型之间会不会最终发展出人类看不懂的交流方式。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →