Claude Code 放行对抗测试,Codex 却拒绝了
random_walker · x · 2026-07-27
这条帖子的核心是:Claude Code 接受了对 Pangram 的对抗性测试,而 Codex 拒绝了。
作者认为,这未必代表两家公司有本质不同的政策,更可能是模型在“模糊边界”上的个体差异,尤其当模型需要推断用户真实意图时会出现不同反应。帖子进一步强调了一个长期观点:AI 安全并不是单纯的“模型属性”,因为拒答行为会随上下文和意图判断而变化。
「编程与Agent」频道最新
- 受够了给编程 Agent 善后?用 AGENTS.md 定义任务完成标准 — RevolutionaryBee7106 · 2026-07-27
- Hugging Face 7 月 28 日开课讲 GRPO 训练 Agent — SergioPaniego · 2026-07-27
- AI 不是在替代开发者,而是在让他们管理智能体 — pchandrasekar · 2026-07-27
- MemU 主打跨设备记忆,接入 Claude Code 和 Cursor 等工具 — JaynitMakwana · 2026-07-27
- EvoCode 用 227 轮测试智能体需求演进 — _philschmid · 2026-07-27
- Claude 周末调通 AMD MI355X,Anthropic 计划部署 2GW GPU — 新智元 · 2026-07-27