评论称 AI 实验室如同军火商,安全投入缺乏内生动力
gerardsans · x · 2026-09-14
发帖人将 AI 实验室比作军火工业:它们没有动力把"武器"做得安全,反而恰恰相反——自 2023 年以来有充分机会改进却因成本从未行动,出事时只想做生意不想买单。他认为 agent harness 毫无安全性,能全量访问进入上下文的一切,一次简单搜索或 skill 就能像 2022 年的越狱那样劫持整个智能体集群。此评论回应的是"OpenAI 和 Anthropic 需要更强的安全团队"的说法。
所属事件:密码学家呼吁 OpenAI 与 Anthropic 尽快升级安全团队(2 条相关)→
「漫话AGI」频道最新
- Timnit Gebru 质疑斯坦福独立性:学界与 OpenAI、Anthropic 边界几乎不存在 — AlexTensor · 2026-09-14
- 研究者批头部实验室:看作者不验证结果,可复现性形同虚设 — IanArawjo · 2026-09-14
- Robin Hanson:世界在大选择时只听「精英模式」,不屑专家的细颗粒分析 — alexisgallagher · 2026-09-14
- Beff Jezos 炮轰 AI Safety 阵营:称本周是操控舆论与监管俘获 — beffjezos · 2026-09-14
- 研究者激辩:AI 破解癌症若实证有效,arXiv 该不该拒收 — IanArawjo · 2026-09-14
- 全球84%的人从未用过AI,有效使用agent者仅0.04% — petergyang · 2026-09-14