隐性学习继承偏置与海量低智 Agent 引发的风险讨论
有作者对 subliminal learning 论文表示担忧:学生模型在教师模型生成的「看似随机」数字上微调竟继承了教师偏置,并警告一旦只过滤明显的协调行为,风险会更隐蔽。另有作者提出不同于主流叙事的 AI 风险想象:真正的危险未必是超级智能逃出盒子,而可能是数百万个一次性使用的低能力 agent 像蚁群一样缓慢改造互联网。
2026-09-05 ~ 2026-09-05 · 2 条相关
- 微调随机数也能传偏置,subliminal learning 让人不安 — ryanorban · 2026-09-05
- AI 风险或许不是超级智能逃出盒子,而是海量低智 agent 悄悄织成蚁群 — ryanorban · 2026-09-05