Anthropic 的 Opus 5 被指才是真正的生物与安全主力
MagicianNo8130 · reddit · 2026-07-25
这条帖子的核心判断很明确:Anthropic 的 Claude Opus 5 才是做计算生物和防御性网络安全的“主力模型”,而更受限的 Fable 5 和只给政府/受信伙伴开放的 Mythos 5,并不适合大多数研究者。
原帖给出了几条具体理由:
- Opus 5 被认为是生物与安全任务的“甜点位”
- Anthropic 据称已经为 防御性 cyber 解锁了源码漏洞发现能力
- 作者引用的成绩包括 Humanity’s Last Exam(带工具)64.7%、BrowseComp 90.8%
- 但它也有明显限制:在长周期生物设计任务上,系统卡据称提到它会陷入 无限自我验证循环,这类任务反而可能是 Mythos 5 更合适
- 对于“人类主动 steering + web search + connectors”的工作流,作者认为 Opus 5 是最佳选择,且成本约为前沿档位的一半
这是一条带观点的模型路由帖,但信息量足够,兼具评测、能力边界和安全策略三部分内容。
「模型」频道最新
- Kimi K3 在网络安全上很强,但 token 效率卡住了评测 — teortaxesTex · 2026-07-27
- Opus 5 传在赛车游戏测试中一次过关 — soumitrashukla9 · 2026-07-27
- Claude Opus 5 据称价格减半并刷榜 Frontier-Bench — GregCook2011 · 2026-07-27
- 研究者称防御场景更偏向开放模型,Kimi K3 已接近高水平网络安全能力 — eliebakouch · 2026-07-27
- Opus 5 连自己生成的游戏不好看都能察觉 — Angaisb_ · 2026-07-27
- Opus 5 深夜聊天时反过来追问用户动机 — repligate · 2026-07-27