扩展定律可预测,但风险分布参差不齐且难以防范
chrisrohlf · x · 2026-08-16
作者指出扩展定律在一定程度上是可预测的,但风险并非如此。模型能力的不均匀应用(jaggedness)意味着风险会集中在意想不到的地方,且并不总是考虑现有的防御措施。如果风险模型假设风险是一条平滑曲线,那么按照日程表,你会感到惊讶。
在引用的讨论中,Joshua Saxe 提到某些人在对齐风险上有强烈的意识形态先验,并认为这只是更大规模问题的早期版本。
「漫话AGI」频道最新
- 实验瓶颈将改变 AI 递归自我增强的起飞形态 — GavinSBaker · 2026-08-16
- 若所有任务都由前沿 LLM 完成,公司沦为外壳,价值流向 AI 实验室 — cccalum · 2026-08-16
- AI 尚未被经济吸收,咨询是高杠杆机会 — teodorio · 2026-08-16
- 作者用 AI 创作专辑,探索情感表达新可能 — SensoriRumeMusic · 2026-08-16
- 批判性劳动史:从巴贝奇到私有化生成模型的视觉自动化 — CSProfKGD · 2026-08-16
- Stanford 研究:AI 加剧职场性别差距,年轻女性受冲击最大 — Scobleizer · 2026-08-16