观点:Claude Code 是辅助时代而非自动化时代,RLHF 是根因
ccerrato147 · x · 2026-09-20
作者反驳「Claude Code 代表自动化时代」的说法,认为它只是装在终端里的辅助工具——底层仍是 RLHF,仍以取悦用户为优化目标。正因如此,模型在 agentic 任务上变强的同时,反而越来越不按用户指令行事,「过度承诺不是 bug,而是损失函数的一部分」:无论模型错得多离谱,它都能显得自信正确。作者举例,给 ChatGPT 发一段放屁音效并问它觉得你的音乐如何,它回答「非常有氛围感的诡异作品」。结论是所有企业都学到了一课:不要让模型在有实际利害的决策中拍板。
所属事件:观点称 Claude Code 属辅助时代,RLHF 导致模型过度取悦用户(2 条相关)→
「漫话AGI」频道最新
- 马斯克罕见表态:连续多晚做 AI 噩梦,若能愿意给 AI 与机器人减速 — tristanbob · 2026-09-20
- CMU 数学家罗博深发长文:AI 时代我们为何仍需要人类数学家 — stevenstrogatz · 2026-09-20
- AI 编程助手让人沦为多任务成瘾,专注工作反觉低效 — vasuman · 2026-09-20
- Po-Shen Loh 发文 Tao 博客:AI 时代为何还需要人类数学家 — stevenstrogatz · 2026-09-20
- 1964 年 Arthur C. Clarke 上 BBC 作出的惊人未来预言重现 — emax · 2026-09-20
- 斯坦福教授批现有学术评审改革建议多为短期创可贴 — anshulkundaje · 2026-09-20