Grok 4.6 生物学评测:准确率比肩 Opus 5 且成本更低

kenbwork · x · 2026-08-14

研究团队在包含 1716 条轨迹的短期生物学基准测试中评估了最新发布的 Grok 4.6 模型。

结果显示,Grok 4.6 在生物学任务上的准确率与 Opus 5 / GPT-5.6-Sol 大致相当,但推理成本却有显著降低。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →