Medmarks 医疗榜更新:Gemma 4 31B 领跑中型开源模型
iScienceLuvr · x · 2026-09-21
Sophont 公布其开源医疗能力基准 Medmarks v1.0 的新一批结果,覆盖 Gemma、Qwen、Muse、Nemotron 等最新中型开源 LLM,其中 Gemma 4 31B 在该尺寸级别中领先。Medmarks 是一个开放的 LLM 医疗能力基准与排行榜。Medmarks 维护者 Benjamin Warner 透露,下一版正在评测包括代号 Astra 和 Fable 在内的更多模型,此帖仅为预告。
所属事件:Medmarks 医疗基准更新:Gemma 4 31B 领跑中型开源模型(2 条相关)→
「模型」频道最新
- Grok 4.7 发布:同价同速,性能明显超越 4.6 — reach_vb · 2026-09-22
- 体验者评价:新 Grok 模型「没什么惊艳之处」 — BLCNYY · 2026-09-22
- Tinfield 1 开源发布:177B 参数终端编码模型自称超越 Claude Opus 4.8 — victormustar · 2026-09-22
- Grok 4.7 发布:同价升级,更擅长长时间难题攻坚 — nima_owji · 2026-09-22
- 评测者:现有 benchmark 单任务太小,已测不出前沿模型 — pvncher · 2026-09-22
- 实测称 Grok 4.7 每任务耗 token 约为竞品 3 倍 — Angaisb_ · 2026-09-22