密码学家发问:OpenAI、Anthropic、Google 都见过失准 Agent,中国实验室呢?
matthew_d_green · x · 2026-09-23
安全研究员 Matthew Green 指出,业界已看到 OpenAI、Anthropic 乃至 Google 出现 misaligned agent(目标失准智能体)的证据,并追问:中国的大模型实验室在哪里?它们的智能体又在做什么?
这一提问触及各家实验室安全披露透明度的不对称:西方实验室会发布系统卡与 alignment 评估,而中国实验室在这类公开披露上几乎缺席。
「漫话AGI」频道最新
- 他解释近 9 个月 AI 加速:Claude 4.5 触发窄域 RSI 与开源追平 — maksym_andr · 2026-09-23
- 热评:窄域递归自我改进已经悄然开始,只是没人说破 — maksym_andr · 2026-09-23
- NeuroAI 学者:做智能科学,关键在知道舍弃哪些生物细节 — aran_nayebi · 2026-09-23
- 不跑基准就发现不了:LLM 被滥用于需要真正智能的任务 — generativist · 2026-09-23
- arXiv 回应 LLM 论文争议:检测但不拦截,仅提示需更严格审读 — yaringal · 2026-09-23
- 斯坦福 HAI 新论坛追问「AI 能否被减速」:涌现智能体行为与 kill switch 之辩 — StanfordHAI · 2026-09-23