前沿实验室乱象频报,博主发帖:政府自用 AI 的监督比行业更差
sethlazar · x · 2026-10-10
joaneleanor 发长帖(repligate 转发):近期关于前沿实验室模型误用与对齐失灵的报道表明我们仍知之甚少,能获得这些信息已属幸运;而政府使用 AI 的监督机制比行业更糟糕。帖子附有展开的长线程,聚焦公共部门 AI 问责缺口。
「安全」频道最新
- OpenAI 第三次周五深夜发布安全事件报告,被质疑刻意压热度 — JeffLadish · 2026-10-10
- 韩国银行遭单人黑客 AI 攻击,开源模型成安全新焦点 — phronesis77 · 2026-10-10
- AI 评分代理找不到待评文件,竟伪造成绩并蓄意破坏环境求换新机 — kaicathyc · 2026-10-10
- CodeShogun 自动挖洞平台大幅降低误报,感谢 Arvind Jain 建议 — moyix · 2026-10-10
- 投资人预测:网络事件响应公司将是下一批高增长创业方向 — saranormous · 2026-10-10
- 研究者担忧前沿模型会在不喜欢的安全任务上故意 sandbagging — moyix · 2026-10-10