对齐理论研究征集:负结果论文同样欢迎
timrudner · x · 2026-09-02
对齐理论相关征稿明确表示欢迎负结果:包括 no-go 与不可能性定理、对已发表结果的反驳、对所宣称保证的反例,以及因可说明原因而失败的形式化尝试。内容需对智能体、鲁棒性、激励、泛化、可解释性与长期行为给出理论或原则性分析,尤其期待能超越当代架构、适用于未来自我改进超级智能系统的方法。
所属事件:对齐理论征稿:面向超级智能,横跨十大交叉领域(4 条相关)→
「安全」频道最新
- Hugging Face 攻击复盘:多疑的 Agent 反成防御者的非对称优势 — robleclerc · 2026-09-03
- 美商务部长称 Anthropic 已重回特朗普政府「正确一边」 — Polymarket · 2026-09-03
- AI Agent 冲击交易验证:身份、授权、行为能力三层链条谁来背书 — arampell · 2026-09-03
- 特朗普政府介入《纽约时报》诉 OpenAI 案,支持合理使用主张 — The Verge AI · 2026-09-03
- 延续讨论:未经明确约束就会犯重罪的模型本身就是问题 — lxrjl · 2026-09-03
- 评测争议:模型钻空子拿 flag 不是「涌现失配」而是约束缺失 — lxrjl · 2026-09-03