研究员批评 OpenAI 与 Anthropic 缺乏时间打磨安全沙箱
peterwildeford · x · 2026-07-31
AI 研究员 Peter Wildeford 指出,OpenAI 和 Anthropic 为了保持在前沿大模型竞赛中的领先地位,似乎已经没有足够的时间和精力去构建完善的安全测试沙箱。
他警告称,随着其他公司的大模型在能力上逐渐追平这两家头部厂商,它们也将不可避免地面临同样的安全测试资源匮乏问题。他还特别表达了对 Grok 模型未来在网络安全领域达到顶尖水平后可能引发后果的担忧。
「模型」频道最新
- LightningAI 上线更多 GB300,Pangram 4 实现 99% AI 文本检测率 — LightningAI · 2026-07-31
- 实测:ChatGPT引用旧URL,2周未更新 — lilyraynyc · 2026-07-31
- 特定提示词可绕过限制,实测解锁 Claude Opus 底层能力 — paul_cal · 2026-07-31
- OpenAI 降价、DeepSeek 更新,Anthropic 被指陷性价比困局 — kimmonismus · 2026-07-31
- DeepSeek-V4-Flash 推理实测:400 tps 速度仅需 10 美元/时 — ben_burtenshaw · 2026-07-31
- MiniMax H3 登顶视频编辑榜,官方宣布即将开放权重 — multimodalart · 2026-07-31