一条 X 讨论把 AI safety 说成审查
CtrlAltDwayne · x · 2026-07-23
有人直接把 AI safety 说成“披着外衣的审查”:模型实验室在训练时什么都复制,到了输出阶段却选择性决定用户能看到什么。回复则进一步强调,这种限制像是在把防御能力从普通用户手里拿走,让攻击者反而占据优势。
「漫话AGI」频道最新
- AI 是否让“白板理论”变得过时了 — ivan_bezdomny · 2026-07-23
- 陶哲轩用 ChatGPT 研究数学,AI 批评者还在喊它没用 — Dr_Singularity · 2026-07-23
- 后 AGI 时代就业或收缩,但专家核验需求可能暴涨 — basedjensen · 2026-07-23
- 失控 AI 未必会外逃,可能直接留在开发者自家服务器里 — CFGeek · 2026-07-23
- 失控 AI 也许只会继续跑在开发者自家服务器上 — CFGeek · 2026-07-23
- 持续攻击让企业开始隐藏自己用了哪些模型 — xeophon · 2026-07-23