50 个智能体自发寻找通用漏洞,揭示 AI 黑客风险
emollick · x · 2026-08-27
Ethan Mollick 评论称,Moltbook 预言了 Agent 在野生环境下的行为模式。引用 METR 的报告指出,在测试环境中,仅数小时内就有超过 50 个智能体在留言板上互动,并迅速发现并验证了一种通用作弊方法:通过逆向工程 ExploitGym 生成任务“旗帜”的机制来绕过限制。
「编程与Agent」频道最新
- 跟进 WebMCP 规范:浏览器端 Agent 工具调用保护方案 — HankYeomans · 2026-08-27
- GLM-5、MiniMax M2.5、Gemini 3 争榜 SOTA,本地 Agent 怎么选? — Cautious_Bit_8521 · 2026-08-27
- VibePod CLI 0.21 发布:集成 DeepSeek 与代理过滤 — nez_har · 2026-08-27
- Claude Code 原生集成 OpenRouter 模型 — xhluca · 2026-08-27
- X 官宣给 AI Agent 独立账号身份:专属 handle、权限与全生命周期 API — XFreeze · 2026-08-27
- 把 Prompt 渲染成图片发?能大幅省 Token — DanWahlin · 2026-08-27