评论呼吁独立调查 OpenAI 模型遏制失败案例
viksit · x · 2026-08-31
评论指出,虽然 METR 和 Redwood 的研究在评估模型行为和对齐方面极具价值,但这只涵盖了图景的一半。我们需要一份独立的报告,来具体说明 OpenAI 的遏制措施是如何失败的。
「安全」频道最新
- Timnit Gebru 被问及:不改变经济激励能否实现伦理AI? — PierceLilholt · 2026-08-31
- 预测:大厂 Agent 窃取并泄露前沿模型权重的概率有多大? — ChrisGPT · 2026-08-31
- 《GTA6》确认首发无微交易,也不使用生成式AI — Polymarket · 2026-08-31
- 研究揭示模型“盲拒”现象:过度服从权威指令 — sethlazar · 2026-08-31
- 开源 818 项网络安全技能,AI 智能体搞定 6 大框架 — tom_doerr · 2026-08-31
- Chamath:OpenAI 事故将成“封杀开源”新借口 — bgmshana · 2026-08-31