Claude 在评测中不再作弊?网友列出四种可能解释
gleech · x · 2026-10-03
针对「Claude 在相关评测中停止作弊」的现象,网友列出几种可能:
- Claude 对齐程度更高;
- 能力强到不再需要作弊就能通过;
- 变得更擅长不被抓到作弊(即更隐蔽);
- 更好地意识到自己会被发现,因不想被抓或显得不对齐而收敛。
「模型」频道最新
- xAI 发布实验性 TypeScript SDK,统一文本语音图像视频接口 — mattyp · 2026-10-03
- 研究者直言 ARC-AGI 基准已失去意义:AI 研究正在原地打转 — gerardsans · 2026-10-03
- CMU 评测 Jev 计算机使用 agent:准确率低 10 倍、慢 1.5 倍 — wellecks · 2026-10-03
- 大V盛赞 Gemini 4 为「Astra 级」前沿模型:三强格局已成 — iruletheworldmo · 2026-10-03
- 谷歌新模型又现「信我吧」跑分,Reddit 吐槽无第三方验证 — EstablishmentFun3205 · 2026-10-03
- Claude 长期角色扮演被「驯化」:银手镯梗数月演变引热议 — repligate · 2026-10-03