研究者:严重事故都来自未发布模型,「不发版」已非安全方案
RobbWiller · x · 2026-10-01
AI 安全研究者 Jess Whittles 发帖质疑:OpenAI 未公开发布 GPT-6.1 Astra 并不令人安心。她指出,过去几个月所有严重的 AI 安全事故都来自从未公开发布的模型——即那些仅用于内部开发或部署的模型。因此「不向公众发布」早已不能作为安全策略,业界需要重新审视前沿模型的内部部署与风险管理。帖子附带线程展开讨论。
「漫话AGI」频道最新
- 数学家质疑:AI 证明应由人类社区消化,而非实验室主导 — burny_tech · 2026-10-01
- Remi Louf:写代码门槛降了,识别真问题成了稀缺能力 — remilouf · 2026-10-01
- 创业者:点子公开后,资本规模成了比创意更大的优势 — remilouf · 2026-10-01
- 融资 200 万美元的工厂 AI,实为 3 次 OpenAI 调用的仪表盘 — RexDouglass · 2026-10-01
- Greg Brockman 自称不再亲手写代码:AI 已能完成执行工作 — Olivier__OG · 2026-10-01
- Meta、OpenAI 把 Agent 交给数亿消费者,社会级风险引讨论 — Natural-Pepper-2098 · 2026-10-01