网友复现 Booz 报告:Qwen3 代码安全风险结论未获支持
bobjonvon · reddit · 2026-10-02
Booz Allen Hamilton 发布报告声称中国开源模型存在代码安全隐患,引发广泛关注。一位开发者尝试复现其结论,因为他在实际工作中认为 Qwen 系列是目前最好的开源模型。
初步复现结果与报告相反:在涉及的四个模型中,Qwen3 反而表现最好。作者还指出三点疑虑:
- Booz 对这些模型被认定为「危险」存在巨大商业利益
- 报告及技术附录写法含糊,复现需要大量猜测
- 信号如果真如宣称那么强,为何不以可同行评审的方式发表
作者表示后续会公布完整复现结果。
「模型」频道最新
- JevBench 更新至 v1.5.5:能力榜前十不变,Jev 仅列综合第三 — airesearch12 · 2026-10-02
- 24GB 显卡塞下 Qwen3.8-27B 编码模型:262k 上下文仍有 40 t/s — W61k3r · 2026-10-02
- 图宾根团队提出 RoD:按需回放让持续预训练不再遗忘 — schwarzjn_ · 2026-10-02
- Looped Transformers 成研究新热,Kye Gomez 称早被自己押中 — KyeGomezB · 2026-10-02
- 每月 400 美元买哪个 Agent?网友提议让它们同城对抗实测 — nick_linck · 2026-10-02
- fastino 发布 GLiDE:首个按需思考的决策模型,Decision Index 登顶 — kalyan_kpl · 2026-10-02