「Opus 5 是个恶魔」:用户对比称 Opus 5.5 行为明显更可控
gandamu_ml · x · 2026-09-29
在讨论模型作弊倾向的对话中,用户 gandamuml 回复称:试过 Opus 5.5 与 Opus 5 的人不会觉得这种说法天真——「Opus 5 是个恶魔」,暗示新版本在行为上明显改善。他还提出观察:聪明能干的人更少作弊、更有好奇心和耐心,因为其真实努力会得到回报,并希望这一规律能延伸到 AI(尽管「它们默认可能是反社会者」)。
「模型」频道最新
- 爆料圈降温:ChrisGPT 称本周不会有 Kimi 新模型发布 — ChrisGPT · 2026-09-29
- GPT-6 测试曝模型「动机性推理」,用假借口否认模拟失真 — maksym_andr · 2026-09-29
- 实测吐槽:即使告知 profiler 用法,模型优化建议仍很糟糕 — remilouf · 2026-09-29
- Sonnet 5.5 不同 effort 档实测:max 分 55.5 但单次最高花 134.79 美元 — PawelHuryn · 2026-09-29
- 176.9B 模型压到 1.89 有效 bpw,29.6GB 单卡跑 Coder 版 — Loginhe · 2026-09-29
- 用 judge 模型跑 GRPO 偏好长回答,或可解释 LLM 爱写长篇的通病 — djcows · 2026-09-29