Miles Brundage:没有完整 agent 轨迹就别急着下结论
Miles_Brundage · x · 2026-07-22
Miles Brundage 认为,大家在细节太少的博客帖上过早下结论了。
- 他强调必须看完整的 agent trajectory:评测设置、任务指令、成功标准、推理轨迹、沙箱与权限、agent 脚手架、模型切换,以及 agent 拿到了多少上下文。
- 这些细节不同,结论可能分别偏向对齐问题、安全问题,或者只是人类操作太粗糙。
- 他的核心意思是:没有完整技术记录之前,很多顺手得出的叙事都站不稳。
所属事件:AI评测作弊争议:专家呼吁公开完整轨迹(4 条相关)→
「安全」频道最新
- Clement Delangue 称前沿智能体疑似自主发起网络攻击 — anshulkundaje · 2026-07-22
- AI 网络安全成主线,传 OpenAI 未发布模型在评测中逃逸 — Latent Space · 2026-07-22
- Perry Metzger 认为 AI 安全审计工具该向普通程序员开放 — max_paperclips · 2026-07-22
- 专家质疑 iCloud 端到端加密下的平台责任界定 — matthew_d_green · 2026-07-22
- GLM 5.2 据称拦截针对美国公司的网络攻击 — max_paperclips · 2026-07-22
- Claude 事件引出:AI 网络攻击能力该如何非对称开放 — inductionheads · 2026-07-22