前沿大模型药物发现评测:Grok 擅长寿命预测,Opus 强于临床试验
DeryaTR_ · x · 2026-08-07
InSilicoMeds 更新了其药物发现与开发基准(Benchmark)门户,新增了 GPT-5.6-Sol 和 Claude Opus-5 两款前沿模型。
测试结果显示,目前没有单一模型能在所有领域通吃:
- Claude Opus-5(Anthropic)在临床试验预测中领先
- GPT-5.6-Sol(OpenAI)主导大型治疗分子相关任务
- Grok 4.5(xAI)在长寿(longevity)相关基准中位列第一
值得注意的是,在许多细分赛道上,通用前沿模型的表现依然不及专门训练的垂直领域专业模型。
「研究」频道最新
- 智能体架构探讨:智能应存在于模型还是外部工具中? — AndrewLampinen · 2026-08-07
- 美国财政部提供 12 万 PDF,推出 OfficeQA Pro V2 基准 — jefrankle · 2026-08-07
- 硬件神经流形结合机器学习,仅用4帧预测癫痫发作 — bravo_abad · 2026-08-07
- Reka AI 发布 RekaDaily-10k 真实家庭视频数据集 — RekaAILabs · 2026-08-07
- mLateOn模型未训练韩语却登顶 MTEB 韩语检索榜首 — IgorCarron · 2026-08-07
- 多模态嵌入重塑 RAG:告别有损转换,原生检索图文音视 — CShorten30 · 2026-08-07