Anthropic 更新 Claude 生物学安全护栏,误报率大降 85%
claudeai · x · 2026-08-07
Anthropic 宣布更新 Claude(文中称 Fable 5)的生物学安全护栏,大幅降低误报率。在内部测试中,该更新使各产品端的生物学相关拦截回退减少了约 85%。
模型现在能协助处理更广泛的日常健康和教育问题。但对于具有双重用途风险的专业请求(如病毒学、毒理学和分子设计),系统仍会回退至 Opus 5 模型处理,以确保前沿能力安全交到专业研究人员手中。
「模型」频道最新
- DeepSeek 预告将大幅上调 API 价格 — sandyyevans · 2026-08-07
- 曝 Ilya 创办 SSI 已开始评测其首款新模型 — zephyr_z9 · 2026-08-07
- Meta 内部模型狂揽五项奥赛金牌,纯推理能力解题 — 机器之心 · 2026-08-07
- 实测DeepSeek-V4对比GPT-5.6:成本仅1/6,质量达80% — zainhas · 2026-08-07
- OpenAI 模型后训练再遭质疑,被指品味不足 — willdepue · 2026-08-07
- 闭源前沿模型陷入安全暂停,开源阵营宣称迎头赶上 — bindureddy · 2026-08-07