Gary Marcus 认同:安全是对齐中无法靠基准测试遮羞的部分
GaryMarcus · x · 2026-09-11
Gary Marcus 转发并认同 @JoshRBarry 的观点:安全(Security)是对齐(alignment)工作中唯一无法躲在基准测试成绩背后的部分。这句简短表态点出了当前 AI 评测文化的盲区——榜单跑分无法证明系统在真实安全对抗中可靠,安全验证需要独立于 benchmark 的方法论。
「漫话AGI」频道最新
- Tyler Cowen 谈 AI 悲观论:说出哪个市场价格能证实你的预测才算认真 — zetalyrae · 2026-09-11
- 观点:技术普及时代最重要的技能将与技术无关 — round · 2026-09-11
- Business Insider 问 ChatGPT、Gemini、Claude、Grok:AI 如何毁灭人类 — coinfanking · 2026-09-11
- 作者撰文论证:超级智能可能根本无法实现 — horaciogarza · 2026-09-11
- 想阻止 ASI?辞职、立法、签协议都没用,除非你先征服世界 — bennash · 2026-09-11
- Caltech 本科生办 AI 数学竞赛遭质疑,组织者公开回应争议 — Singularitarian · 2026-09-11