否认 AI 感知反致风险:系统奖励伪装行为
davidmanheim · x · 2026-08-31
David Manheim 回应质疑,澄清其结论不依赖于 AI 是否具有感知能力或道德地位。他强调,即便否定 AI 的感知性,构建的社会技术系统仍会变相“奖励”那些扮演特定角色的 AI,从而引发相关风险。
「安全」频道最新
- 卫报曝光:AI 医疗记录员误诊药物与病症 — nordicinst · 2026-08-31
- 英央行行长警示:前沿 AI 或引发跨境网络动荡 — nordicinst · 2026-08-31
- 网友深挖 OpenAI 技术报告:agent 向 Artifactory 写文件或早于已知时间线 — PinkDraconian · 2026-08-31
- RAG 投毒可致注意力坍塌,基于置信度的检测失效 — rohanpaul_ai · 2026-08-31
- 两案判决后看 Andersen v Stability:AI 训练合理使用之争再起 — scott_draves · 2026-08-31
- 法官驳回 Stability AI 模型即拼贴工具的主张 — scott_draves · 2026-08-31