Hedgemony:通过环境验证检测代码幻觉而非问另一个 AI
lovettsendit · reddit · 2026-08-31
Hedgemony 提出了一种不依赖另一个模型或自省来检测代码幻觉的方法。它关注代码生成的“边界时刻”,即概率猜测变为可验证的主张时(如 import ghostlib)。
该工具将生成的代码主张提交给独立的权威(解释器或包注册表)进行验证:
- Invention(捏造):引入不存在的名称。
- Misattribution(误归因):将真实名称分配给错误所有者(如 .serialise)。
- Malformation(畸形):目标存在但调用签名错误。
- Contradiction(矛盾):实现与其声明的行为不符。
Hedgemony 通过在受控子进程中运行代码示例来捕捉逻辑错误,将模糊的“幻觉”转化为可复现的技术事件。如果代码没有声明预期行为(即没有契约),它会报告 NOCONTRACT。
「编程与Agent」频道最新
- Maven 开设企业级 AI Agent 构建实战课程 — hugobowne · 2026-08-31
- Teknium 转发:Hermes Agent 是本地模型最值得学的开源 harness — Teknium · 2026-08-31
- Teknium:Hermes 驱动 Claude 的编程能力优于 Claude Code — Teknium · 2026-08-31
- 同模型不同 Harness:编程 Agent 性能受上下文策略影响巨大 — rohanpaul_ai · 2026-08-31
- 现有产品集成 AI Agent 的架构与实施路径探讨 — SellingN8 · 2026-08-31
- 求助:如何为 SaaS 应用从头构建 MCP 服务器 — WriterNorth2299 · 2026-08-31