ADLC 为何雷声大雨点小:谁来做 Agent 的对抗性安全测试?
Specialist-Bee9801 · reddit · 2026-09-04
发帖人指出,AI Agent 开发生命周期(ADLC)被频繁讨论,但很难找到团队日常真实落地的第一手经验,尤其是安全测试环节:软件每次部署都会跑测试,那对 AI 行为的对抗性测试理应在每次重要部署时执行——但实际上由谁负责?测什么?什么情况会拦下发布?
帖内向已采用 ADLC 的团队征集答案:哪些做法有效,哪些最终沦为没人执行的纸面流程。
「编程与Agent」频道最新
- 自建编码评测VulcanBench-SWE v4:超时升至10小时防失真 — ChrisUniverse · 2026-09-04
- Bespoke Labs 用 SFT+GRPO 把开源模型按代码库定制,提升 57 个百分点 — heghbalz · 2026-09-04
- automationbench 基准:astra 正确完成 41.4% 业务工作流创纪录 — jdjohnson · 2026-09-04
- Sentry 创始人自述:用 Agent 生成爬虫,加确定性校验防跑偏 — zeeg · 2026-09-04
- 同一 diff 三家模型评审:Claude 83 分、GPT-5.6 仅 32 分 — lumir2026 · 2026-09-04
- 1.6 万次实测:AI 编码智能体最爱选 Stripe、Vercel 等工具 — Saboo_Shubham_ · 2026-09-04