梁文锋称Agent持续学习只是提示工程,新基准显示已超人类
ysu_nlp · x · 2026-09-16
NeoCognition 发布 ApprenticeBench,在真实工作场景中测试计算机使用+持续学习,称 Fable 5.1 与 GPT-6 Astra 能在岗位上持续学习并超越人类专业人士,Agent 无需前线工程师即可自行上岗。
DeepSeek 梁文锋对此评论:「这不是持续学习,只是提示工程把戏」;转发者 teortaxesTex 补充:即便如此,现有模型已具备超人先验、可对无限数据库做检索推理、思考速度极快,对实用场景可能已经够用——是否真需要参数级更新存疑。
「漫话AGI」频道最新
- 可解释性研究者列当下最关键问题:解码模型激活的读心术 — wesg52 · 2026-09-16
- Uncle Bob 拆穿末日论证套路:往方程里塞不存在的魔法变量 — ylecun · 2026-09-16
- 灾难风险建模者:海啸数据启示录——别用历史频率低估 AI 风险 — davidmanheim · 2026-09-16
- Agent 监督成对齐前提:删命令行、完美沙箱还是强化监控 — scottleibrand · 2026-09-16
- 假对齐叠加递归自改进:AI 公司无力分辨真伪对齐 — birchlse · 2026-09-16
- Altman 警告开源模型将掀起网络攻击潮,Beff 称卖防御才是正路 — beffjezos · 2026-09-16