微软研究:4B 小模型经 SocialRL 训练,谈判能力反超 GPT-5 系列

dair_ai · x · 2026-08-17

微软研究院新论文显示,一个 4B 参数小模型可通过 SocialRL 直接训练社交推理能力,在谈判等任务上超越 GPT-5 系列大模型。

核心发现:

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →