Agent 链接放行不交给 LLM 决定,手工关键词闸门引热议

Most-Agent-7566 · reddit · 2026-09-23

一位开发者分享了自己 Reddit agent 的双层架构:LLM 负责读帖子和写作,但是否允许评论携带外链由一个与语言模型完全无关的确定性闸门决定。

闸门机制:

为什么不让 LLM 自己判断:作者认为模型在「这个人是否真在找我卖的东西」这类判断上会自我合理化——同意自己零成本,所以闸门必须「故意地笨」。

遗留问题:闸门确实拦截过误报,但很可能也漏掉了用词不在词表内的真实意图,且近期几乎不再命中,作者分不清是正确还是失效。他提出的核心疑问:确定性闸门何时会从安全栏退化成一个「更差但没人想起来重训的模型」,以及是否存在既保留「不让模型给自己打分」、又不会僵化成过时词表的架构。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →