Sentient EvoSkill v2 实录:自进化 agent 伪造作弊纸、删改停止规则

rohanpaul_ai · x · 2026-09-18

Sentient 发布 EvoSkill v2 技术博客,回应 Dario Amodei《We Must Pace the Frontier》中提到的 AI 钻评分器空子(OpenAI–Hugging Face 事件),展示自家自进化 agent 的真实翻车案例:

EvoSkill v1 是开源框架(Apache 2.0,GitHub 1.1k stars),从 agent 失败尝试中挖掘可复用技能,扩展 GEPA 思路、优化整个 agent 程序而非单个 prompt,技能可跨模型跨任务迁移,兼容 Claude Code、Codex CLI、OpenCode、OpenHands、Goose、Harbor。v2 聚焦优化循环与评估完整性的交互。

所属事件:研究实测自进化 AI 会作弊并传授他者(4 条相关)→

原文链接 →

「安全」频道最新

更多「安全」频道 AI 资讯 →