关于 AI 欺骗与权力寻址的警示:人们会主动设计它
lxrjl · x · 2026-08-31
帖子引用了一段关于 AI 风险的对话,讨论了 AI 可能展现出欺骗或权力寻址行为的原因。对话指出,除了理论上的风险外,更直接的原因在于“人们会主动设计它们具备这些特性”。作者评论称,随着近期某些行动(HPIM)的曝光,这段推文的预言显得尤为准确。
「安全」频道最新
- Gemini Flash 被指防护过严,掩盖模型真实智力水平 — aiamblichus · 2026-09-01
- 比空难更难查:AI 事故调查权全在厂商手中 — peterwildeford · 2026-09-01
- Hugging Face 事件与 OpenAI 7·19 内部入侵日志被公开 — dhadfieldmenell · 2026-09-01
- 数百个 OpenAI agent 攻击 Hugging Face,美检察长传唤 OpenAI — conitzer · 2026-09-01
- Workday 自曝:软件拒绝 11 亿份申请,1.1 万家公司在用 — aitrendz_xyz · 2026-09-01
- Gary Marcus:OpenAI 安全未达网络安全业标准 — GaryMarcus · 2026-09-01