CMU 跨学科工作坊:用理性主体框架解读 AI 信念与对齐
brwilder · x · 2026-09-29
作者参加了 CMU 举办的「AI agency and interpretability」工作坊,哲学家与计算机科学家共同探讨如何用理性主体的视角理解和解释 AI,以及由此引出的安全议题。
作者的核心感受是对这一方向更乐观了:
- 两个学科有大量可以互相学习的地方;
- 无论在理论还是实证层面,都有一批重要问题值得研究:检验理性主体框架是否是好工具、推断模型可能「拥有」怎样的信念或欲望;
- 这些判断的结论会直接影响机制设计、训练与对齐的实践。
所属事件:CMU工作坊汇聚哲学与CS学者探讨AI能动性与可解释性(2 条相关)→
「漫话AGI」频道最新
- 研究者预测:AI 将速通数学猜想,转向材料与药物发现 — tak3sh8 · 2026-09-30
- 哲学家 Carissa Véliz 拒绝「新卢德分子」标签:反对监控式 AI 不等于反技术 — CarissaVeliz · 2026-09-30
- 智谱开源 GLM-5.3 或被攻击者滥用,开源模型失去追查攻击的记录抓手 — davidmanheim · 2026-09-30
- AI 把炫富造假成本归零:廉价信号不再传递任何信息 — aakashgupta · 2026-09-30
- AI Agent 数量或已达数十亿,安全专家吁当作不可信身份管理 — CurieuxExplorer · 2026-09-30
- 开发者直言超个性化音乐是伪命题:音乐本质是社交文化 — jordiponsdotme · 2026-09-30