开源模型对齐之争:「让 AI 听用户的」能否从闭源迁移仍存疑
BlancheMinerva · x · 2026-09-14
这是 Blanche Minerva 与 @yonashav 关于开源模型对齐讨论的后续。@yonashav 澄清他说的对齐指「让 AI 按用户意愿行事」而非防滥用护栏;Minerva 回应称按这个定义,闭源到开源确实会有大量技术迁移,但前沿实验室并不希望这种迁移发生,因此不能假设它们会开发出全部必要技术。
所属事件:开源模型对齐之争:闭源技术能否迁移引发激辩(4 条相关)→
「安全」频道最新
- 低价 token 服务商藏雷:假 tool call 窃密、转卖完整 trace — Nils_Reimers · 2026-09-14
- Dario 回应护栏争议:宁可被嘲笑,也不愿 Claude 被用来杀人 — TinfoilTricorn · 2026-09-14
- 争论:不开源不等于安全,对齐模型需算力碾压不对齐模型 — basedjensen · 2026-09-14
- Lina Khan:现行法律无 AI 豁免,未经审核模型发布可被追责 — ambaonadventure · 2026-09-14
- 把 AI 当人管:用人类治理框架思考 AI 风险 — AdaptiveAgents · 2026-09-14
- NL2SQL 的隐藏风险:查询正确不等于权限正确 — awsamanai · 2026-09-14