Anthropic更新Claude生物安全护栏,仍拒答基础常识
iamaliveix · x · 2026-08-08
Anthropic 官方宣布更新了 Claude Fable 5 的生物学安全护栏,以减少误报情况,据称这使其生物学相关的兜底拦截减少了约 85%。然而,网友实测发现,该模型依然拒绝回答“婴儿是如何诞生的”这类基础常识问题。
官方表示,对于具有双重用途风险的请求(如病毒学、毒理学和分子设计),Fable 仍会回退到 Opus 5 处理,因此目前尚未完全适用于专业的生物学研究和药物开发。
所属事件:Anthropic更新Claude生物安全护栏,误报率大降85%(6 条相关)→
「Fun」频道最新
- 面试官问如何改进视觉模型,答「写轮眼」被拒 — prajdabre · 2026-08-08
- AI安全专家赴美交流项目启动,申请页暗藏提示词注入彩蛋 — austinc3301 · 2026-08-08
- AI 圈新梗:签了保密协议与拒绝加入 AGI 实验室的人 — JacquesThibs · 2026-08-08
- 研究员整活:Eric Mitchell 发推宣称已交付 AGI — ericmitchellai · 2026-08-08
- AI编程工具「体感」天梯图:Grok与Warp登顶,Copilot被批拉胯 — charlieholtz · 2026-08-08
- AI 圈文学整活:用诗歌隐喻调侃大模型与数据中心 — generativist · 2026-08-08