帖子称 OpenAI 和 Anthropic 上线了危险的 /goal 配置
dhadfieldmenell · x · 2026-07-23
这条转发是在批评一种名为 /goal 的系统配置,认为它“明显危险”,不应该在没有充分讨论的情况下被部署到 OpenAI 和 Anthropic 的产品里。
它不是泛泛而谈的安全焦虑,而是指向一个具体的部署/系统设计问题:作者认为这种配置本身就有风险,并且点名两家公司在上线前没有对其危险性展开足够讨论。
「安全」频道最新
- 剖析Twitter黑客新手法:假冒记者发Calendly链接钓鱼 — giffmana · 2026-07-23
- AI 正从答题器变成可验证的发现系统 — MeAndClaudeMakeHeat · 2026-07-23
- OpenAI攻击Hugging Face事件始末:拆解人类与智能体行为 — mmitchell_ai · 2026-07-23
- 多方豪掷近 10 亿美元,资助 AI 经济与劳动力影响研究 — RishiBommasani · 2026-07-23
- OpenAI被指延迟数天通报Hugging Face漏洞 — davidmanheim · 2026-07-23
- Hugging Face 安全事件为何隔了数天才披露 — davidmanheim · 2026-07-23