实测阿里 Qwen3.8 Max:处理病历能识别用药矛盾但留坑
MaziyarPanahi · x · 2026-08-06
开发者在处理医疗出院小结时实测了阿里 Qwen3.8 Max 模型。在温度设为 0 的多次测试中,模型表现稳定,成功梳理了四处用药变更,并准确识别出遗漏的速尿剂剂量而没有擅自填补。
不过,该测试仅基于单一样本,且三次运行耗时在 23-34 秒之间,尚不能作为严谨的基准评测。
所属事件:实测 Qwen3.8 Max 处理病历:理清用药但留坑(2 条相关)→
「模型」频道最新
- t0-alpha 时间序列预测基础模型发布,采用 Apache 2.0 开源 — fpedregosa · 2026-08-06
- MiniMax 发布 H3 全模态模型:支持图生视频与原生音频 — RisingSayak · 2026-08-06
- MiniMax 发布 33B 开源多模态模型 H3,支持图声视频生成 — RisingSayak · 2026-08-06
- 谷歌模型赢了评测却输了开发者 — prasenx · 2026-08-06
- 曝 OpenAI 下周发布新模型 Astra,为 GPT-4.5 后最大预训练 — koltregaskes · 2026-08-06
- Google 发布 8 月 AI 更新:推 90 个复用 Agent 技能与托管基础设施 — rseroter · 2026-08-06