为何模型规模难以预测下游能力?这篇论文定位了原因

BlancheMinerva · x · 2026-09-28

Blanche Minerva 在讨论串中补充另一篇论文《Why Has Predicting Downstream Capabilities of Frontier AI Models with Scale Remained Elusive?》,解释为什么前沿模型的下游能力比预训练 loss 更难随规模预测。

这是对「AI 安全员做什么」的第二个实证回答:让模型能力的规模扩展可预测,本身就是工程与政策都依赖的研究工作。

所属事件:EleutherAI 研究员回应安全性质疑并分享两篇论文(2 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →