研究员激辩:人类与AI的泛化困境及安全对齐焦点

JacquesThibs · x · 2026-08-11

JacquesThibs 在推文中调侃一种普遍的乐观论调:即“大多数人类在分布外(OOD)的泛化能力其实也很差”。

在被回复的上下文中,他进一步指出,虽然“人们还没准备好”加上“如果它奏效意味着时间线很短,所以假设它奏效是最好的预期价值(EV)赌注”这种逻辑有其道理,但如果不去深入理解当前模型失效的具体机制,而仅仅将其归咎于模糊的“Scaling”,可能会导致研究精力被投入到错误的安全对齐方向上。

所属事件:业界激辩LLM泛化能力与Scaling Law神话(3 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →