Zvi 说 Opus 5 病毒学不输 Fable,引出安全管控问题
TheZvi · x · 2026-07-25
Zvi 认为 Opus 5 在病毒学任务上不输 Fable
这条帖子配了多张基准图,Zvi 的核心判断是:Opus 5 在病毒学相关任务上的表现至少和 Fable 一样好。他随即抛出一个监管层面的反问:如果 Opus 5 已经能做到这个水平,却不需要 Fable 那套生物分类器限制,那为什么 Fable 还要受这些约束?
图里展示了几组结果:
- AAV packaging rate classification:无监督分类场景
- Long-form virology tasks:序列设计、流程设计、端到端任务
- Multimodal virology and DNA synthesis screening:多模态病毒学与 DNA 合成筛查
图表中同时对比了 Opus 4.7 / 4.8、Sonnet 5、Mytho 5 和 Opus 5,帖子借这些结果强调:如果能力差距没那么大,模型限制与监管标准可能就不该差得这么多。
所属事件:Claude Opus 5 病毒学能力引安全争议(2 条相关)→
「模型」频道最新
- AutomationBench 图表显示 Opus 5 更强于长程智能体任务 — daniel_mac8 · 2026-07-25
- Claude Opus 5 进入 GitHub Copilot 和 Microsoft Foundry — DanWahlin · 2026-07-25
- CursorBench 3.2 显示 Claude Opus 5 仅落后 Fable 5 0.5 分,成本减半 — EricBuess · 2026-07-25
- Hyperagent:Opus 5 更强,但 GPT-5.6 Sol 更便宜更好落地 — TawohAwa · 2026-07-25
- 传 Opus 5 性能碾压 Fable 5,下一代模型竞争白热化 — haider1 · 2026-07-25
- Qwen3.5-9B 非审查 GGUF 变体登上 Hugging Face 趋势榜 — DavidAU · 2026-07-25