传 Anthropic 内部模型 Mythos 已进行半年 RL 训练

scaling01 · x · 2026-08-08

有推文爆料称,Anthropic 的内部模型 Mythos 向员工大范围开放已近半年。该消息源指出,经过 6 个月的强化学习(RL)hillclimbing 训练,该模型展现出的能力进化令人感到“可怕”。(注:此为非官方证实爆料)

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →