妙喻:亚里士多德德性伦理学本质是一种RLVR机制
curious_vii · x · 2026-09-03
作者提出一个有趣的类比:如果把德性伦理学看成一套训练机制——通过反复实践正确行为养成品格习惯——那它本质上就是一种 RLVR(可验证奖励强化学习):德性即是对「做得对」的奖励信号的内化。一句话把古典伦理学与 RL 训练范式勾连起来,适合当思考起点。
「漫话AGI」频道最新
- Gary Marcus 转发:LLM 只是「往墙上扔东西的机器」加个评估器 — GaryMarcus · 2026-09-03
- KOL 称 Claude Mythos 5.1 因网络与生物能力过强未开放访问 — VraserX · 2026-09-03
- AI 高手谈下一波影响:把工作流拆成可验证任务,刻意使用胜过随手用 — hermanschutte · 2026-09-03
- 卫报播客:坐牢20年后,Gemini 的一条邀请改变了他的人生 — nordicinst · 2026-09-03
- AI 自主风险 2023 年预测复盘:agent 化与无人监控全中 — davidmanheim · 2026-09-03
- Patterson 提议对 AI 公司收入征统一销售税 — rand_longevity · 2026-09-03