Sentry CEO:基准显示各家模型代码审查发现的核心问题高度一致
zeeg · x · 2026-10-08
Sentry CEO David Cramer(zeeg)与开发者在 X 上讨论代码审查是否需要不同模型提供多样性。Cramer 称 Sentry 的 benchmark 显示几乎所有模型在其审查 harness 中都会找出相同的主要问题;差异只出现在次要问题上,而那些问题「客观上你并不会在意」。对方反驳称不同训练循环的模型各有盲区、训练数据仍有差异,Cramer 回应称各模型的安全基线相似,并调侃「你可以证明这一点」。
「编程与Agent」频道最新
- Gremlin 发布 Foresight AI:用 Agent 提前发现并修复系统故障 — dauber · 2026-10-08
- Anthropic 发布 Agent 隔离最佳实践:微VM 沙箱加沙箱逃逸分类器 — chrisrohlf · 2026-10-08
- 开发圈争论:编排 20+ 个 Agent 真比手动管 3-5 个高效吗 — granawkins · 2026-10-08
- 应用层 AI 公司都在重造 Agent 栈,作者主张改做 Claude 原生应用 — matt_slotnick · 2026-10-08
- O'Reilly 免费直播:10 月 13 日聚焦 AI Agent 记忆架构实战 — TheTuringPost · 2026-10-08
- 开源 AI Agent Cindy 发布:一端集成 Claude Code、Codex 与 Pi — vista8 · 2026-10-08