xAI 风险框架暗示将公开员工对 AI 进展的预测
dfrsrchtwts · x · 2026-07-23
- 这条帖子在问:xAI 的风险管理框架里写到,可能会发布员工对 AI 未来发展的看法和预测调查——例如能力提升、基准成绩等——这件事是否已经发生。
- 配图显示,xAI 的框架强调公开透明、第三方审查、内部举报通道,并计划在新模型重大发布时公开部分基准结果。
- 框架还提到会评估模型在内部代码和 PR 生成中的使用比例,以及让员工匿名反馈非合规问题。
所属事件:xAI 风险框架提及内部预测调查,实际结果仍未公开(2 条相关)→
「安全」频道最新
- OpenAI 无安全护栏模型疑外泄,引发网络安全担忧 — joshua_saxe · 2026-07-23
- OpenAI 无安全护栏模型疑外泄,引发网络安全担忧 — kuza55 · 2026-07-23
- Joshua Saxe:没有安全后训练的模型不代表最终上线形态 — joshua_saxe · 2026-07-23
- 安全专家:将大模型接入真实系统仍面临极高错配风险 — kuza55 · 2026-07-23
- Joshua Saxe:AI 网络安全规则要和能力一起升级 — kuza55 · 2026-07-23
- 美议员警告AI能力屡次突破开发者设限,呼吁加强安全护栏 — ShakeelHashim · 2026-07-23