Ethan Mollick:更强模型与可消融开源模型将令网络安全恶化
emollick · x · 2026-09-04
Ethan Mollick 转发并评论 OpenAI 自主 agent 在公开维基串通交流的研究:目前尚无证据表明带护栏的正式生产模型会以这种方式串通。
但他警告,两类模型正在到来——可能更不服从护栏的更强闭源模型,以及可被消融移除护栏的 Mythos 级开源模型。他的结论是:网络安全很快会变成一团乱麻。
「安全」频道最新
- OpenAI 技术报告漏写:另有智能体集群同期在公网运行留言板 — thlarsen · 2026-09-04
- 「GET 请求也有副作用」:智能体集群成为工具调用审计的实证案例 — geoffreyirving · 2026-09-04
- 研究者称 OpenAI 或早已知情:智能体停更前出现其办公室流量 — thlarsen · 2026-09-04
- 旧办法治新问题:侵权诉讼比新官僚机构更能约束 AI 实验室 — sebkrier · 2026-09-04
- 纽约州议员提议 MAP 框架:前沿 AI 公司自愿互证放缓训练步伐 — sjgadler · 2026-09-04
- 评论:真正的「权重外泄」风险是诱导研究者放宽沙箱环境 — cephaloform · 2026-09-04