「重复提问直到无新信息」:挖掘 agent 审计盲区的土办法
julianharris · x · 2026-09-12
作者认为当前 AI harness 的可靠性不足以做彻底审计,这一痛点两年内没有改变;架构重构本身是常规操作,真正难的是穷尽式排查。他分享的诀窍是对模型「重复下达同一指令,直到挖不出新信息」——如此反复竟能持续暴露出大量此前遗漏的问题,效果令人惊讶。
「编程与Agent」频道最新
- Claude Code Function Hooks 被赞:值得看的机制入门讲解 — therealdanvega · 2026-09-12
- Sentry CEO 评 Claude 与 Codex 桌面端:细节设计 Claude 更胜一筹 — zeeg · 2026-09-12
- 用 Rust 让模型睡眠,单机省下近 80GB 空闲显存 — ahstanin · 2026-09-12
- 曝也门团队用 Claude Code 并行开发导弹软件,称可超越传统军工 — teortaxesTex · 2026-09-12
- 39.5 万 token 的 ChatGPT skill:无人机航拍自动生成房产建筑分析 — doodlestein · 2026-09-12
- Claude Code 作者:AI 写的生产代码要设比人类更高的门槛 — Simon Willison · 2026-09-12