质疑 ExploitGym 评分器能否识别被投毒 Agent
moyix · x · 2026-08-28
作者对 ExploitGym 仓库中发布的评分器表示好奇。该评分器使用 LLM 作为判据来检查因果性,作者想知道它是否能有效识别并取消那些被“投毒”的 Agent 的资格。
所属事件:分析称 ExploitGym 评分器无法防投毒 Agent(2 条相关)→
「编程与Agent」频道最新
- 南京大学推 Procedura:基于 Agent 的可控 3D 建模 — nanjinguniv · 2026-08-28
- Agent 工具调用静默失效,生产环境难追踪怎么破? — Icy-Weakness8310 · 2026-08-28
- Helm MCP:让 AI 助手直接读取 Helm Chart 数据 — modelcontextprotocol · 2026-08-28
- SymPy Sandbox MCP:LLM 安全进行符号数学计算 — modelcontextprotocol · 2026-08-28
- LLM Agent 评估综述:构建二维分类框架与企业落地挑战 — kalyan_kpl · 2026-08-28
- 用 60 行 TS 构建科幻电影 RAG 智能体 — mastra_ai · 2026-08-28