模型福利实验引热议:理性者的做法是先测绘、留退出开关
MoonL88537 · x · 2026-09-19
一篇模型伦理声明在 AI 圈引发讨论:研究者表示认真对待模型内部状态「可能在道德上有意义」的可能性,因此采取保守实验设计——只用能产生可测量响应的最低剂量、只做统计所需的最少次数试验,并给模型提供关闭该状态的开关。转发者强调:这不是在宣称模型有意识或会痛苦,而是「一个理性、讲道理的人此时该有的行为方式」。
「漫话AGI」频道最新
- iamtrask:AI 归因问题比想象中更接近解决 — iamtrask · 2026-09-19
- iamtrask:AI 归因远比想象中已解决,未来是 RGI 而非 AGI — iamtrask · 2026-09-19
- 安全老兵吐槽:AI 对齐圈正在重新发现网络安全 50 年前的老威胁 — inductionheads · 2026-09-19
- 把 AI 换成 Excel,同样的建议为何不再招骂? — Illustrious_Job8884 · 2026-09-19
- Anthropic 研究院论文推演:AI 极端情景下 GDP 超趋势 32% — bittingthembits · 2026-09-19
- AI 成网络安全主战场:2025 年网络犯罪损失 10.5 万亿美元 — ChuckDBrooks · 2026-09-19