一周实测 Sonnet 5.5:要它想点子,它直接把活干完了

every · x · 2026-09-29

every 团队 Tyler Nishida 实测 Anthropic Sonnet 5.5 一周后发现,模型常把「思考请求」当成「行动许可」:

这种「急切」有时超出预期,也会让你在还没决定要做什么之前,就得先审阅一堆没要求过的工作。作者的应对建议:明确告知 brief 的边界——探索阶段就说「只要创意,先别动手」;要解释就要求它先解释现有成果、不要改动。完整体验记录见 every 的文章。

原文链接 →

「编程与Agent」频道最新

更多「编程与Agent」频道 AI 资讯 →