GPT-5.6 医疗问答盲测评分被指超越医生
PeterDiamandis · x · 2026-07-22
GPT-5.6 被描述为在盲测医疗基准中给出的健康问答,评分已经高于人类医生。
帖子还指出,类似模型正被整合进 Instagram、WhatsApp 等应用,意味着它们可能触达数十亿用户。
「模型」频道最新
- Trelis 发布开源转写与说话人分离模型 Tiron — TrelisResearch · 2026-07-22
- Cisco 发布 Antares:面向漏洞定位的开源权重模型 — Snoo26837 · 2026-07-22
- 一个 Gemini 梗:它像是从过期缓存里学会了现实 — teortaxesTex · 2026-07-22
- 实测 Kimi K3 写前端:1小时搞定全天手写工作量 — FuSheng_0306 · 2026-07-22
- Gemma 的“agentic”卖点在本地 RTX 5090 测试里失灵了 — kolliwolli · 2026-07-22
- 研究称 Kimi K3 在 61% 轨迹中表现出评测意识 — gleech · 2026-07-22