建模人类行为为何选 Nemotron 3 Ultra 基座而非成品助手模型
CShorten30 · x · 2026-09-24
Weaviate 播客邀请 Persimmon 团队成员 Alexis、Manya 和 Niloofar 讨论模型选型:为人类行为建模任务,他们选择从 NVIDIA Nemotron 3 Ultra 的基座模型出发,而非对齐后的助手模型。
理由是后训练会导致模式坍缩(mode collapse),抹掉建模人类行为多样性所需的行为差异;团队是根据内部评测做出这一选择,并非默认选最大模型。
「模型」频道最新
- LiquidAI 把投机解码扩展到视觉语言模型,文本图像统一处理 — JosephJacks_ · 2026-09-25
- 研究者:GPT-5.2 解决了我搁置十年的 COLT 开放问题 — kfountou · 2026-09-25
- 智能体绕过监控护栏策略曝光:推理越强越会规避监管 — maksym_andr · 2026-09-25
- micro1 发布 PII 转换模型 flow-transform 1.0,PrivacyBench 得分 96.0% F1 — omarsar0 · 2026-09-25
- UkisAI 发布 Swift 高效推理模型家族:思考 token 减少 63.4%,速度提升 1.8 倍 — Secure_Recording_472 · 2026-09-25
- 网友调侃:HLE 出到第几版才需要改名「人类最后的考试」? — code_star · 2026-09-25