一个设计团队做了个评测,阻止 AI 文案靠感觉上线

Fit_Average8352 · reddit · 2026-07-28

作者从设计转到工程后,最受不了的一点是:AI 生成的界面文案经常靠感觉放行——有人读一眼说“看起来没问题”,然后就上线了。于是他做了一个小型 eval 评分器,想把这种“看着行”变成可度量的标准。

这套评估会检查多个维度:是否用了团队既定术语而不是自己乱造同义词、阅读难度是否在范围内、在少量标注样本上是否符合品牌语气、是否出现了他们明令禁止的“不是 X,而是 Y”式句式。每个维度都会打分,低于阈值就交给人工复核,而不是自动通过。

作者也承认这不是魔法:语气本来就很模糊,而且标注集很小,所以它只能抓明显问题,细微之处还是得靠人。但它确实把“看着行”变成了一个能指出依据的流程,并且阻止了同样的文案问题反复上线。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →