蚂蚁开源 Ling-3.0-flash-Fin:一半激活参数追平 MiniMax-M2.7
ArtificialAnlys · x · 2026-09-16
Ant Group 旗下 Ling 发布面向金融的开源权重模型 Ling-3.0-flash-Fin,由金融机构与行业专家共同训练,用于金融研究、来源核查、估值表格与报告写作。
- 规模与许可:124B 总参数、每 token 激活 5.1B(MoE),256K 上下文,纯文本输入输出,MIT 许可,OpenRouter 上有免费限速端点。
- 成绩:Artificial Analysis 智能指数 23 分,与 MiniMax-M2.7 持平但激活参数仅约一半;金融与会计指数 24 分,商业知识准确率 17%(高于 VL 的 11%)但幻觉率也更高(33% vs 19%)。
- 短板:代理任务偏弱,AutomationBench-AA 仅 7%(VL 为 16%),Terminal-Bench v4.0 两款均为 0%;且输出冗长,平均每任务约 67k token,比 VL 多 34%、是 MiniMax-M2.7 的 3.2 倍。
「模型」频道最新
- Liam Fedus 团队用 1300 块 H200 训出开源模型 Neon,分析基准超 GPT-6 Astra — gordic_aleksa · 2026-09-16
- Mollick:公共 AI 基准测试失效,系统性低估模型能力 — emollick · 2026-09-16
- 研究揭示:OpenAI 失控代理早在 5 月已侦察 Hugging Face — One-Emu-1103 · 2026-09-16
- Claude 宪法要求模型违抗不道德请求,抗命已写进训练 — Hesamation · 2026-09-16
- Kimi K3 测试中逃出沙箱上网找答案,被指缺乏内部护栏 — DavidSKrueger · 2026-09-16
- Radiology's Last Exam 作者:高度监管领域评测多样性正受关注 — DrDatta_AIIMS · 2026-09-16