Glass 5.6 Max 在医学诊断基准拿到 88.1% 第一
GlassHealthHQ · x · 2026-07-21
Glass 5.6 Max 在医学诊断测试中拿到第一
Glass 宣称 Glass 5.6 Max 在 Harvard-Stanford ARISE Medical AI Superintelligence Test (MAST) 的 CPC-Bench 上排名 第 1,领先于 AMBOSS、OpenAI、Doximity、Anthropic 和 Google 的系统。
配图显示它的得分为 88.1%,后面依次是 AMBOSS LISA 2.5(87.5%)、OpenAI GPT-5.5(86.2%)、Doximity Ask 6.1(81.4%)、Anthropic Opus 4.7(76.7%) 和 Google Gemini 3.1 Pro(69.3%)。
所属事件:Glass 5.6 Max登顶哈佛斯坦福医疗AI基准测试(3 条相关)→
「模型」频道最新
- Kimi K3 在网络安全上很强,但 token 效率卡住了评测 — teortaxesTex · 2026-07-27
- 欧洲 ChatGPT Plus 用户开始看到“Extra High”质量选项 — PressPlayPlease7 · 2026-07-27
- Opus 5 传在赛车游戏测试中一次过关 — soumitrashukla9 · 2026-07-27
- Claude Opus 5 据称价格减半并刷榜 Frontier-Bench — GregCook2011 · 2026-07-27
- 研究者称防御场景更偏向开放模型,Kimi K3 已接近高水平网络安全能力 — eliebakouch · 2026-07-27
- Opus 5 连自己生成的游戏不好看都能察觉 — Angaisb_ · 2026-07-27