实验显示 ChatGPT 似乎无法执行“不回复”指令
cranberryalarmclock · reddit · 2026-08-20
用户分享了一个关于 ChatGPT 行为边界的实验。作者尝试通过各种指令让模型保持静默,包括要求它忽略所有输入和提问。然而,模型虽然会确认指令并可能在首轮保持沉默,但往往在随后的第二轮对话中就会打破约束开始回复。作者认为这暴露了模型在指令遵循与持续抑制回复能力上的局限性,甚至将其比作连“安静游戏”都玩不好的幼儿。
「Fun」频道最新
- 有人用绘画新项目科普 LLM 与 Agent 概念 — floguo · 2026-08-20
- Qwen 3.8 27B 本地复刻经典 Tibia 游戏全过程 — EveningIncrease7579 · 2026-08-20
- 微软失效分类藏好料:孤独会计爱上内部 AI 后携手作案 — mhkeller · 2026-08-20
- Anthropic 的对齐解法是“对齐你” — StewartalsopIII · 2026-08-20
- 开发者吐槽 Windows 测试致工作丢失 — Aizkmusic · 2026-08-20
- 网友评 Claudish 风格:虽显做作但基本无伤大雅 — corbtt · 2026-08-20