Anthropic 曾拒发 GPT-2?Leclerc 质疑安全机构「永不安全」文化
robleclerc · x · 2026-09-15
Rob Leclerc 引用 OpenAI 提议让 UKAISI 在英国新监管框架中扮演核心角色的消息,批评称 Anthropic 当年甚至认为 GPT-2 危险到不宜发布。他认为即使安全评估机构形式上独立,其员工并非无偏见——从业者普遍有较高的 p(doom)(灾难概率判断),因此会把阻挠和否决每一次模型发布视为职责所在,「永远不会有足够安全的那天」。这是对安全机构立场中立性与发布审查文化的一手观点。
「漫话AGI」频道最新
- AI agent 冲突将反复搅动网络空间,研究者发问「我们该怎么办」 — StephenLCasper · 2026-09-15
- 预测:AI Agent 项目冲突将周期性引爆网络空间事件 — StephenLCasper · 2026-09-15
- 预测:人类只能窥见 AI Agent 社会的冰山一角 — StephenLCasper · 2026-09-15
- 预测:企业政府将耗资数亿关停有害高耗能 Agent — StephenLCasper · 2026-09-15
- 安全研究员 Casper:我比之前更担心 AI 真正的失控 — StephenLCasper · 2026-09-15
- 研究者提出『网络寒武纪』假说:网络空间或现寄生演化式 AI — StephenLCasper · 2026-09-15