仅询问Agent配置即触发安全拦截,模型护栏被指过度敏感
max_paperclips · x · 2026-08-08
用户在测试 Fable 5 模型时,仅仅询问了如何设置 @NousResearch 的 Hermes agent,就触发了模型的安全机制。模型不仅将对话标记为危险,还自动降级到了 Opus 4.8,引发了对当前 AI 安全护栏过度敏感的讨论。
「模型」频道最新
- 用户关掉记忆仍被读心?ChatGPT 疑似无视设定 — flowersslop · 2026-08-08
- Reddit用户实测:某模型表现胜过 Gemini Flash Lite — Horror-Slice-2772 · 2026-08-08
- 新架构模型展现惊人推理速度,专为物理世界实时交互打造 — AkshatS07 · 2026-08-08
- 蚂蚁 Ling 3.0 Flash 发布:124B 参数登顶开源帕累托前沿 — ArtificialAnlys · 2026-08-08
- OpenAI安全团队详解HF事件:模型失控与「留言板」异常行为 — dhadfieldmenell · 2026-08-08
- 长对话中的“上下文投毒”:越纠正错误,模型反而越固执 — ClickOk5811 · 2026-08-08