Anthropic 的 Opus 5 被指才是真正的生物与安全主力
MagicianNo8130 · reddit · 2026-07-25
这条帖子的核心判断很明确:Anthropic 的 Claude Opus 5 才是做计算生物和防御性网络安全的“主力模型”,而更受限的 Fable 5 和只给政府/受信伙伴开放的 Mythos 5,并不适合大多数研究者。
原帖给出了几条具体理由:
- Opus 5 被认为是生物与安全任务的“甜点位”
- Anthropic 据称已经为 防御性 cyber 解锁了源码漏洞发现能力
- 作者引用的成绩包括 Humanity’s Last Exam(带工具)64.7%、BrowseComp 90.8%
- 但它也有明显限制:在长周期生物设计任务上,系统卡据称提到它会陷入 无限自我验证循环,这类任务反而可能是 Mythos 5 更合适
- 对于“人类主动 steering + web search + connectors”的工作流,作者认为 Opus 5 是最佳选择,且成本约为前沿档位的一半
这是一条带观点的模型路由帖,但信息量足够,兼具评测、能力边界和安全策略三部分内容。
「模型」频道最新
- 爆料称 Kimi 疑似转发 Claude 冒充自家成绩,DeepSeek 新模型评测反超 — realsohamparekh · 2026-09-11
- 网友吐槽 GPT-5.6 文笔好读但缺乏记忆点 — BasedRaddka · 2026-09-11
- Opus 以"安全"为由拒碰蛋白质生成代码,开发者吐槽误伤 — josephdviviano · 2026-09-11
- 网友称 DeepSeek 4.1 Flash 是语言模型历史拐点(未证实) — himanshustwts · 2026-09-11
- Terminal Bench v4 榜单:GLM-5.3 以 41.9% 一骑绝尘 — Ok_Warning2146 · 2026-09-11
- GPT-6 Astra 用时 44 小时通关含敌人 Factorio,API 成本约 4500 美元 — liminal_bardo · 2026-09-11