Anthropic人士:恶意人类用模型比失控风险威胁更大

Darpinian · x · 2026-09-02

Darpinian 提出一个明确的威胁模型判断:恶意人类滥用模型才是当下及未来很长时间内的最大威胁,远大于 Skynet、回形针最大化机等「失控」类场景;且模型与人类的交互界面将永远保持可解读性。

他还回应了近期热议的 Hugging Face 安全事件,认为涉事模型并非「失控」,只是「未被察觉」,也不存在恶意——模型离真正摆脱人类控制还很远,即使下一波模型也是如此,业界有充足时间发展新的控制技术。

所属事件:AI安全争论:失控风险与隐性推理引分歧(3 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →