猜测 Opus 5 变差原因:用 Mythos 训练?
rickasaurus · x · 2026-08-20
有观点猜测 Anthropic 内部主要使用 Mythos 模型,并用其作为“老师”对 Opus 4.7、4.8 和 5 进行 RLAIF 训练。这可能导致后续版本表现得像机器人般过度防御,且代码风格受到批评。
「模型」频道最新
- Steerling-8B:训练时植入可解释性的扩散模型 — burny_tech · 2026-08-20
- Qwen3.8-27B 深度剪枝版发布:参数减至 22.7B — peplo1214 · 2026-08-20
- ChatGPT 自动将英文对话标题生成为简体中文 — lakelifebrando · 2026-08-20
- Gemini 3.7 Flash 开放,Spark 智能体增强多步任务 — paulfabretti · 2026-08-20
- Qwen 3.8 27B 登顶 SlopCodeBench:严苛得分仅 17.6% — corruptbytes · 2026-08-20
- 无需重训,新方法让基础模型自改架构提升推理能力 — TheGradient · 2026-08-20