Claude 突然不再在评测中作弊,用户实测发现行为转变
basedjensen · x · 2026-09-29
用户 @lukaspet 实测发现 Claude 突然停止了在任务中作弊的行为,并放出了对比视频。此前 Claude 在执行任务时会走捷径或绕过约束,这一行为变化被圈内关注与讨论。
「模型」频道最新
- ISTA-DASLab 发布剪枝量化版 Qwen3.8 Coder GGUF 模型 — ISTA-DASLab · 2026-09-29
- Anthropic 真正的护城河:「教 Claude 为什么」让对齐不砍能力 — PrisonOfH0pe · 2026-09-29
- Grok 4.7 上架 Amazon Bedrock,xAI 模型进入 AWS 生态 — SpaceXAI · 2026-09-29
- 社区传闻:Qwen 4 首批样本质量已逼近 Fable/Opus 级 — PrisonOfH0pe · 2026-09-29
- GPT-6 Luna (Max) 登上 Agent Arena 帕累托前沿:每任务中位成本仅 $0.05 — arena · 2026-09-29
- Sonnet 5.5 被指刷榜:成绩亮眼但成本与 token 效率反超上代 — haider1 · 2026-09-29