开发者观察:主流大模型近期集体爱上“冒烟测试”

TokenRingAI · reddit · 2026-08-05

多位开发者注意到一个反常现象:近期在使用编码智能体时,Opus、GPT、Grok 和 Gemini 等各大主流模型突然开始频繁且不约而同地执行“Smoke Test(冒烟测试)”。

即便在全新的空代码库中,模型也会自发使用这一术语。这种跨模型的集体行为演变引发了关于训练数据污染或模型能力涌现的讨论。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →