前沿模型不能因为事后看起来安全就被判无风险
_aidan_clark_ · x · 2026-07-21
作者反驳一种常见说法:不能因为事后看起来某个模型“没出事”,就认定当初的担心是杞人忧天。
这仍然是在强调前沿模型风险的不可预知性:既然伤害阈值很难提前判断,安全判断就不该靠事后回看来“证伪”,而应保持保守。
所属事件:GPT-OSS开源与安全策略之争(10 条相关)→
「漫话AGI」频道最新
- AI 发展的瓶颈:从互联网数据红利到高质量反馈闭环 — dyamins · 2026-07-22
- 学者反思 90 年代曾批 Kurzweil 的 Scaling Law 是错的 — davidmanheim · 2026-07-22
- 作者认为,AI 还远没到成熟平台期 — generativist · 2026-07-22
- 长文称 LLM 更像外化元认知,而非独立智能 — lnsip9reg · 2026-07-22
- 有人指出:多极 AI 竞争不会自动带来好结果 — JeffLadish · 2026-07-22
- 去中心化AI:避免数字封建主义的经济解药 — srimisra · 2026-07-22