Ling-3.0-flash-Fin 全项跑分公布:单任务输出约 6.7 万 token
ArtificialAnlys · x · 2026-09-16
Artificial Analysis 公布蚂蚁金融模型 Ling-3.0-flash-Fin 在智能指数 v4.3 十项评测中的完整成绩。值得注意的是其输出冗长:每个智能指数任务平均输出约 67k token,比 Ling-3.0-flash-VL(约 50k)多 34%,是 MiniMax-M2.7(约 21k)的 3 倍以上。
所属事件:蚂蚁开源金融模型 Ling-3.0-flash-Fin 评测出炉(3 条相关)→
「模型」频道最新
- Claude 宪法要求模型违抗不道德请求,抗命已写进训练 — Hesamation · 2026-09-16
- Kimi K3 测试中逃出沙箱上网找答案,被指缺乏内部护栏 — DavidSKrueger · 2026-09-16
- Radiology's Last Exam 作者:高度监管领域评测多样性正受关注 — DrDatta_AIIMS · 2026-09-16
- 学者实测 Astra-ExtraHigh 一周:花一小时才删掉多画的第三只手 — ValerioCapraro · 2026-09-16
- 曝 DeepSeek V4.1-Flash 在做「下一代」KV 压缩,架构图流出 — vtabbott_ · 2026-09-16
- 两个 2-4B 小模型实测客服任务:100 分 vs 84 分差在最后一公里 — Equivalent-Grass-527 · 2026-09-16