让三个模型同室共写 AI 监管提案:高风险活动须先审批
DeliciousGorilla · reddit · 2026-10-01
发帖人让 Claude Opus 5.5、GPT-6 Astra 和 Kimi K3 在同一共享会话中互相批评、共同修订,写出了一份前沿 AI 监管提案。核心主张:
- 高风险活动事前审批:监管机构有权审批达到风险阈值的训练、权重发布和部署;标准须公开制定、累计评估,小步规避不了审批;权重发布需单独审批;评估须由独立于开发方的机构执行,包括去除护栏后的测试;审批有期限,逾期未决不得默认通过。
- 监管落地手段:可按风险下令暂停、限制访问和整改;对实验室与算力运营方设可执行的报告义务(遏制失败、未授权 agent 行为、严重误用须限期上报);保护吹哨员工;记录防篡改。
- 责任跟着控制力走:按各方预防能力分配义务与责任。
提案还引用了 OpenAI 承认前沿训练安全案例仍在完善、Anthropic 报告开源模型存在可被去除护栏的高级漏洞能力等事实,论证自愿承诺应替换为法律义务。
「Fun」频道最新
- AI 加速科研:arXiv 同一天提问同一天作答 — KyleCranmer · 2026-10-01
- 用户吐槽 ChatGPT 订阅取消不了 — imjustnewatai · 2026-10-01
- 波兰网友神回复:我们早管 AI 叫 SI 了 — tlakomy · 2026-10-01
- OpenAI 研究员自嘲:模型发布让我「回复晚了」有了正当理由 — divy93t · 2026-10-01
- 不想要 AI 小伙伴?网友:我想要一个诡诈的宦官军师 — tedmitew · 2026-10-01
- 「AGI 达成了」:Reddit 梗图调侃式庆祝 — GeneReddit123 · 2026-10-01