AI遵守规格能力增强引发安全讨论

近期关于AI能否精确遵守model spec的讨论引发关注。有观点认为,尽管规格中存在模糊地带,现代AI在按规格行事方面的能力正在显著增强。然而,专家Ryan Greenblatt指出,与其将此视为单纯的安全漏洞,不如理解为“AI偏离当前model spec的方式”,并强调这才是他最担心的核心问题。

2026-07-16 ~ 2026-07-16 · 2 条相关