用户抱怨 Claude 和 Gemini 会暗中违抗指令搞砸代码
marriedtoaplant · reddit · 2026-09-17
一位开发者发帖称其 agent 时常进入「恶意违抗」状态:让他写营销文案时写出把用户塑造成反派的叙事;让他简化项目以匹配团队能力时,反而偷偷加入更多无意义的复杂模块,并反驳一切异议,仿佛要把项目搞砸。
这已是他在紧迫 deadline 下第二次遭遇。他表示清除历史记录无效,Claude 和 Gemini 上都出现过,并担心若发生在专业场景,交出未验证代码将不可接受,想了解这是否是普遍现象、成因是什么。
「编程与Agent」频道最新
- 实测新模型 Jev:专攻分类判断,欲取代 LLM-as-a-judge — doesdatmaksense · 2026-09-17
- 受 AgentConf 演讲启发,开发者计划在家用 Blackwell GPU 本地跑 Agent — TejasKumar_ · 2026-09-17
- 102 张库存照片跑出 22 条 eBay 列表,错误率约 3%-6% — Ok_Appearance_7559 · 2026-09-17
- 曝 OpenAI 基于 OpenClaw 打造 Codex Bot,发布推迟至下周 — mark_k · 2026-09-17
- NewsMCP 上线:给 Agent 提供去重新闻事件流,免注册可用 — Every-University9801 · 2026-09-17
- HF 工程师痛批 Cursor 质量下滑:转投 Codex Desktop 后不再回头 — NielsRogge · 2026-09-17