ClinFusion 论文上线,提出医学视觉评测新基准
aigclink · x · 2026-08-01
本条补充了阿里达摩院开源医学多模态模型 ClinFusion 的 arXiv 论文链接与详细摘要。
论文核心指出,将多模态大语言模型(MLLM)部署到医疗领域本质上是一个以视觉为中心的挑战。ClinFusion 提出了一种包含 CaSL 融合算子的组合级联视觉编码器架构,统一了对 2D 和原生 3D 医学图像的理解。
此外,研究还引入了一套基于视觉的评估框架:包含用于评估指令遵循能力的 MedIF-Bench,以及一种结合感兴趣区域(ROI)的方法,用于评估临床对齐度和基于事实的报告生成能力。实验表明,ClinFusion 在多项综合指标上达到了 SOTA。
所属事件:阿里达摩院开源医学多模态模型 ClinFusion(2 条相关)→
「多模态」频道最新
- MiniMax H3动漫视频实测:面部一致性优异,但存在动态瑕疵 — OneTrueTreasure · 2026-08-01
- MCP赋能AI Agent操作Houdini:自动搭建程序化节点 — anselm · 2026-08-01
- Krea2新增原生编辑LoRA,Forge Neo用户可启用 — cradledust · 2026-08-01
- 实测 MiniMax 视频模型:生成科幻微电影《Ensign Daniel Vale's First Day》 — bennash · 2026-08-01
- Midjourney 8.2 结合 GPT-2 生成动画效果惊艳 — beechinour · 2026-08-01
- Seedance 2.5实测对比:物理重量感与细节显著提升 — socialwithaayan · 2026-08-01