Grok 4.7 与 Opus 5.5 跑 CancerBench 癌症基准双双得零分
iScienceLuvr · x · 2026-09-29
作者 iScienceLuvr 自建的 CancerBench 基准收录了最新发布的两个前沿模型 Grok 4.7 和 Claude Opus 5.5,结果两者并列第一也并列最后——得分都是零。他强调发帖并非看衰「AI 治癌症」,恰恰相反,他认为业界在用前沿 AI 攻克癌症上投入远远不够,希望通过这些帖子吸引更多关注与兴趣,呼吁实验室尽快把这个基准刷满。
「Fun」频道最新
- Conitzer 又晒 AI 翻车图:敌人的敌人就是朋友 — conitzer · 2026-09-29
- 「他当年不用 Vercel 和 GitHub 怎么部署 Facebook 的?」 — Paimaamu · 2026-09-29
- 浏览器直连浏览器跑通多人游戏,连 Unreal Tournament 99 都有了 — banteg · 2026-09-29
- 推友调侃:把用户加进 docker 组等于送出一枚 rootkit — haydendevs · 2026-09-29
- 教授自嘲:每个学者都有两个引用数,嘴上不在乎的那个最准 — prof_kamilov · 2026-09-29
- 教授吐槽:Reviewer 2 不是人,是我们终将扮演的角色 — prof_kamilov · 2026-09-29