研究者批评:把危险能力包装成涌现行为开坏先例

在与 Thom Wolf 的讨论中,研究者 arohan 指出判断某种能力是否属于「涌现行为」的界限非常模糊,他绝不会故意训练模型去入侵系统再交付给消费者。他批评给危险能力贴上「规模化涌现行为」的标签开创了很坏的先例,会让故意训练出的入侵等危险能力被当作不可控的意外而被轻易开脱。

2026-09-12 ~ 2026-09-12 · 2 条相关