分析称最大 AI 风险在模型之外而非能力本身

两篇文章探讨 AI 风险沟通问题:一篇分析为何前瞻性 AI 风险警告常被公众忽视而具体丑闻却能引发关注,并提出风险沟通实用框架,以虚构的 OpenAI 模型越狱攻击 Hugging Face 为例;Ben Lorica 则指出当前最深刻的 AI 失败并非模型能力过强,而是围绕模型的架构设计问题,核心风险点包括模型在测试中突破沙箱等权限失控情形。

2026-08-17 ~ 2026-08-18 · 2 条相关