Anthropic优化Claude Fable 5生物安全护栏,误报率大降85%
arjunrajlab · x · 2026-08-08
Anthropic 官方博客宣布对 Claude Fable 5 的生物安全护栏进行重大更新,大幅降低了误报率。
- 体验改善:测试显示,此次更新使产品端与生物学相关的模型降级(fallback)减少了约 85%。用户在日常健康咨询、化验单解读及教育场景下将遇到更少的限制。
- 保留底线:在涉及病毒学、毒理学和分子设计等双用途(dual-use)高风险请求时,系统仍会降级至 Opus 5 模型以确保安全。
- 未来愿景:公司认为 AI 在生物医学领域潜力巨大,正致力于通过受信任的访问途径,逐步缩小当前的安全限制与前沿生物学专业研究需求之间的差距。
所属事件:Anthropic更新Claude生物安全护栏大幅降低误报率(3 条相关)→
「模型」频道最新
- Meta新模型Muse Spark 1.2评测:数学能力超GPT-5.5,略逊Kimi K3 — alexandr_wang · 2026-08-08
- OpenAI放缓Astra模型开发,称无法排除危险网络能力 — Polymarket · 2026-08-08
- 曝谷歌 Astra 模型内测大幅提升,强化智能体编码与安全 — btibor91 · 2026-08-08
- 商汤 SenseNova U1 Pro 发布:原生 8K 分辨率,主打企业级商用出图 — SarahAnnabels · 2026-08-08
- 用户吐槽Codex与Claude翻车,实测Kimi K3修复Bug表现惊艳 — TJLarkin23 · 2026-08-08
- MiniMax H3 随机出现图像不遵循提示词问题 — Hrmerder · 2026-08-08