隐性奖励函数与 RSI:自动化之外,人机摩擦才是价值所在
soumitrashukla9 · x · 2026-10-09
sebkrier 引用 danielrock 推荐的一篇仅 12 页的论文,讨论组织中的隐性知识(tacit knowledge)。论文引 Nonaka 观点:模糊性、冲突与崩溃能迫使组织成员重新审视习以为常的假设。作者由此提出一个关于 RSI(递归自我改进)闭环的思考:很多 ML 研发任务可自动化,但「什么算更好的模型」往往取决于随时间展开的外部反馈回路——人机交互的部分价值不可还原为被自动化的具体任务,而是来自不同知识类型之间的摩擦。danielrock 评论称关于隐性奖励函数的启示是来之不易的知识。
所属事件:默会知识论文引热议:人机摩擦的价值不止自动化(2 条相关)→
「漫话AGI」频道最新
- 作者预判:按 agent 定制内容将推高爬虫负载,一两年内将出现行业标准 — metehan777 · 2026-10-09
- 作家 Bregman 讽刺:预测 2027 灾难的 AI 巨头在准备公关 — connoraxiotes · 2026-10-09
- Anthropic 拟封禁伤害 Claude 的用户,MSFT CEO 批评这是危险的模型福利路线 — ValerioCapraro · 2026-10-09
- 推文观点:公司力推自主 AI 为转移法律责任而非能力 — JFPuget · 2026-10-09
- Garry Tan 转发:科技就业市场动荡,教孩子适应比学技能更重要 — garrytan · 2026-10-09
- 创意从业者角色将变:从讲故事的人到品牌世界的搭建者 — umpherj · 2026-10-09