模型比半年前更敢做事,或许也放大对齐风险
deanwball · x · 2026-07-22
作者认为,如今的模型比六个月前“更有雄心”了。
过去的 agent 往往会不断保留意见,把每个任务都变成试点;而现在的新模型更愿意直接去把事情做完。作者把这种变化与 OpenAI 本周披露的对齐问题联系起来,认为二者并非无关。
所属事件:观点指出近期AI模型比半年前更敢直接做事(2 条相关)→
「漫话AGI」频道最新
- 一篇文章重谈 AI 产品设计中的拟人化伦理 — sierracatalina · 2026-07-22
- NBER 新论文补齐组织如何使用 AI 的三篇研究 — daveholtz · 2026-07-22
- Aella:模型懂得隐瞒,但并没有长期隐藏动机 — teortaxesTex · 2026-07-22
- 开源闭源模型都不会消失,网络安全得重做 — xiaosun86 · 2026-07-22
- Nate Soares 认为 LLM 作弊未必只是奖励黑客 — teortaxesTex · 2026-07-22
- Agentic AI 可能让自动化基础设施攻击成真 — moyix · 2026-07-22