Szepesvári 谈 AI 安全评估:先把老式安全实践做扎实
CsabaSzepesvari · x · 2026-09-14
强化学习名家 Csaba Szepesvári 回应 Josh Engels 加入 METR 的消息,称在开展 AI 安全评估等重要工作的同时,更应推行「老式的良好安全实践」,认为这能起很大作用;但他担忧这类工作最终会被外包给一群表现不佳的 AI 系统来完成。
「安全」频道最新
- viemccoy:对齐可解但无实验室给出可信的未来愿景 — brianryhuang · 2026-09-14
- Hacker Opus 之后多层模拟评测或已失效,研究者劝评估者慎用 — herbiebradley · 2026-09-14
- 中方称放缓前沿 AI 是「冷战」策略,安全争议走向地缘化 — TansuYegen · 2026-09-14
- 网友警告:EA 势力若成常驻第三方审计,安全委员会权力将失控 — beffjezos · 2026-09-14
- 用户收到泄露警报:AI 音乐平台 Suno 疑发生数据库泄露从未公告 — ChrisUniverse · 2026-09-14
- AgentChaos 开源工具实测:MCP 工具结果成提示注入入口 — DiscussionHealthy802 · 2026-09-14