实测:用“基因组”替代 Prompt 驱动 Agent
MonokoEloba · reddit · 2026-08-26
作者实测了 GenOS,这是一个通过版本化 YAML“基因组”而非巨大 Prompt 来驱动 LLM Agent 的环境。通过突变特征(如 risktolerance)和“繁育”专业 Agent,作者实现了涌现式 TDD,绕过了 RAG 上下文限制,并完全避免了多 Agent 之间的“乒乓”循环。
测试场景:修复一个有 38 个 lint 错误和隐蔽安全漏洞(未转换货币直接累加)的 PaymentProcessor.ts。
结果对比:
- Prompt 基线(失败):简单 Agent 保留了安全漏洞;注入 600 tokens 规则的专家 Agent 需 3 次迭代才修复,且 Token 开销巨大。
- 基因组突变(成功):设置 verificationthreshold = 0.80 后,Agent 拒绝直接动生产代码,而是自主先写了测试用例(涌现式 TDD),抓住了安全漏洞。调整 syntaxstrictness 后,零额外 Token 修复了所有 lint 错误。
- 繁育替代群组:将“安全审计员”和“性能工程师”的基因组繁育为子代,单次通过即写成了通过所有安全检查且吞吐量达 21 ops/ms 的 AES-256-GCM 加密引擎,无需多 Agent 互相辩论。
「编程与Agent」频道最新
- Salesforce 推出 Agent Script 深度解析视频系列 — msrivastav13 · 2026-08-26
- LikeC4:从代码实时生成软件架构图的工具 — tom_doerr · 2026-08-26
- 研究称 Agent 框架对分数影响大于模型本身 — rohanpaul_ai · 2026-08-26
- 大厂为何自建 AI 基础设施而非购买? — bendee983 · 2026-08-26
- AI 技能加持知识管理,实现规模化效能 — dSebastien · 2026-08-26
- Phonebook:基于 MCP 的移动端预览画廊工具 — orelzion · 2026-08-26