Grok 4.7 与 Opus 5.5 跑 CancerBench 癌症基准双双得零分

iScienceLuvr · x · 2026-09-29

作者 iScienceLuvr 自建的 CancerBench 基准收录了最新发布的两个前沿模型 Grok 4.7 和 Claude Opus 5.5,结果两者并列第一也并列最后——得分都是零。他强调发帖并非看衰「AI 治癌症」,恰恰相反,他认为业界在用前沿 AI 攻克癌症上投入远远不够,希望通过这些帖子吸引更多关注与兴趣,呼吁实验室尽快把这个基准刷满。

原文链接 →

「Fun」频道最新

更多「Fun」频道 AI 资讯 →