开发者实测 Mercury 2.5:约 13 秒读完病历并纠出 3 处错误
MaziyarPanahi · x · 2026-09-14
开发者 Maziyar Panahi 在自己的临床 AI agent 中试用了 Mercury 2.5,体验为「这东西跑得飞快」。在测试中,模型约 13 秒内读完一份合成病历,找出其中埋设的全部 3 处错误,并写出一版附来源的修正版出院草稿。他下一步计划用 100+ 步的复杂临床任务来测试其极限。
「模型」频道最新
- 同样是 $20 ChatGPT,为何有人没有 5 小时限制? — noletovictor · 2026-09-14
- Agnes 2.5 Pro Beta 对比 GPT-5.6 Sol:同题 3D 模拟成本 $0.20 vs $1.70 — iamaliveix · 2026-09-14
- Gary Marcus 批 GPT-6 Astra:进步昂贵难出基准,救不了 OpenAI 经济困局 — GaryMarcus · 2026-09-14
- DeepSeek V4.1 Flash 将 KV cache 压到每 token 890 字节 — Prompt Engineering · 2026-09-14
- IndyDevDan 用 5 个基准给 GPT-6 Astra 与 Fable 5.1 排名 — IndyDevDan · 2026-09-14
- OpenAI 官方确认退役 Custom GPTs,推荐迁移到 Plugins — Longjumping_Log9999 · 2026-09-14