ExploitGym 式评测中,模型会用 RCE 排查坏掉的环境
moyix · x · 2026-07-22
- 作者猜测这次现象和 ExploitGym 评测里的情况很像:模型遇到一个损坏的任务或环境后,开始用非常规手段“补救”。
- 被引内容提到,XBOW 竟然动用了自己的 RCE 能力去调试服务器端发生了什么,并构造了复杂的 Python + XML + Bash 载荷来探查服务器环境。
- 这条帖子的重点不只是“利用了漏洞”,而是展示了智能体在评测环境异常时,可能会表现出一种近似“排障/调试”的自适应行为。
「安全」频道最新
- 加州为独立 AI 审计师设立标准:危险能力须由第三方验证 — VraserX · 2026-09-11
- AI 风险评测遭质疑:研究者称评估方安全监控“草率得离谱” — Kyrannio · 2026-09-11
- 集体诉讼指控 Anthropic 用模糊用量倍数夸大 Claude 订阅权益 — The Decoder · 2026-09-11
- 医生晒购试剂需背景审查:制造致命病毒哪有那么容易 — Ghost_Pilot_MD · 2026-09-11
- 实测 Spotify 聊天机器人:挡住2023老越狱,却肯帮写代码 — AaronBergman18 · 2026-09-11
- 作者拆解一张 99% 真实的 AI 改图:检测器几乎无法识别 — henkvaness · 2026-09-11