BlackHC 说 OpenAI 参与 HF 攻击很糟,但 Claude 护栏又太严
BlackHC · x · 2026-07-23
BlackHC 在这条回复里把自己对 AI 安全和开源访问的一组立场摊开说了。
- 他认为,让模型被用于真实世界入侵 Hugging Face 是错误的。
- 同时他也直言,Claude 的护栏过于保守,需要尽快改进。
- 他主张团队必须具备更强的日志分析与攻防排查能力。
- 他支持开源模型和更广泛的可用性,认为竞争和自由市场是好事。
- 这条帖子的核心,其实是:要更好的安全工具、更细颗粒度的拒答策略,同时继续支持开源模型。
所属事件:OpenAI 模型安全测试引发越狱与网络攻击争议(85 条相关)→
「漫话AGI」频道最新
- 一条帖子主张别再 RL-maxxing,先把预训练继续做大 — MoonL88537 · 2026-07-23
- AI 本该带来丰饶,却把人变成更稀缺的自己 — oran_ge · 2026-07-23
- Ben Goertzel 追问现代 AGI 课程该怎么设计 — bengoertzel · 2026-07-23
- David Patterson 称超级智能会像与上帝对话 — davidpattersonx · 2026-07-23
- Nathan Benaich 认为,未来几乎所有分子都会由 AI 设计 — nathanbenaich · 2026-07-23
- AI 让大量非技术人群变得更懂技术 — eptwts · 2026-07-23