Zvi 说 Opus 5 病毒学不输 Fable,引出安全管控问题
TheZvi · x · 2026-07-25
Zvi 认为 Opus 5 在病毒学任务上不输 Fable
这条帖子配了多张基准图,Zvi 的核心判断是:Opus 5 在病毒学相关任务上的表现至少和 Fable 一样好。他随即抛出一个监管层面的反问:如果 Opus 5 已经能做到这个水平,却不需要 Fable 那套生物分类器限制,那为什么 Fable 还要受这些约束?
图里展示了几组结果:
- AAV packaging rate classification:无监督分类场景
- Long-form virology tasks:序列设计、流程设计、端到端任务
- Multimodal virology and DNA synthesis screening:多模态病毒学与 DNA 合成筛查
图表中同时对比了 Opus 4.7 / 4.8、Sonnet 5、Mytho 5 和 Opus 5,帖子借这些结果强调:如果能力差距没那么大,模型限制与监管标准可能就不该差得这么多。
所属事件:Claude Opus 5 病毒学能力引安全争议(2 条相关)→
「模型」频道最新
- AI 日报:传 OpenAI GPT-Live-1 上 API,Pro 订阅暂停新注册 — koltregaskes · 2026-09-11
- 同题 Echo Maze 实测:三大模型看似成功,代码里藏着同一个 bug — eyishazyer · 2026-09-11
- 新基准一出分数暴跌 70 点:「刷榜」现象如何让跑分失真 — airesearch12 · 2026-09-11
- ChatGPT 竟劝用户「问题太复杂,去试试更笨的回答」 — phido3000 · 2026-09-11
- 有人要建全模型基准分数汇总页 — airesearch12 · 2026-09-11
- 爆料称 Kimi 疑似转发 Claude 冒充自家成绩,DeepSeek 新模型评测反超 — realsohamparekh · 2026-09-11