MIT 用受限 Python 执行器提升临床大模型计算准确率
MIT · hf · 2026-09-15
MIT 在 Hugging Face 发布的研究提出一种 program-solve 接口,把临床语言模型的算术计算委托给受限 Python 执行器。
- 对较大的开源权重模型,该方法显著提升临床计算器(clinical calculator)任务的准确率
- 对较小模型则改善不一致
- 作者强调该方案不能替代经验证的公式和可靠的变量抽取
对医疗 AI 的可靠性工程是一个有实证意义的探索。
「研究」频道最新
- 蛋白质设计新综述:用更少氨基酸维持结构与功能 — KevinKaichuang · 2026-09-15
- Wayve 研究员:机器人领域难现颠覆性目标函数,仍是下 token 预测变体 — m_wulfmeier · 2026-09-15
- ORQA 论文:116 个职业实测 LLM 专业知识,前沿模型仅得约六成 — soumitrashukla9 · 2026-09-15
- 11 步手推变分自编码器,一笔画懂 KL 散度与重构损失 — ProfTomYeh · 2026-09-15
- 果蝇全脑连接组新发现:靠突触权重快更新导航,LLM 不会这招 — tszzl · 2026-09-15
- Hyperstition 宣称预训练成本降 62%,小模型数学击败 Qwen3 — nick_linck · 2026-09-15