扩展定律可预测,但风险分布参差不齐且难以防范

chrisrohlf · x · 2026-08-16

作者指出扩展定律在一定程度上是可预测的,但风险并非如此。模型能力的不均匀应用(jaggedness)意味着风险会集中在意想不到的地方,且并不总是考虑现有的防御措施。如果风险模型假设风险是一条平滑曲线,那么按照日程表,你会感到惊讶。

在引用的讨论中,Joshua Saxe 提到某些人在对齐风险上有强烈的意识形态先验,并认为这只是更大规模问题的早期版本。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →