传 Anthropic 内部模型 Mythos 已进行半年 RL 训练
scaling01 · x · 2026-08-08
有推文爆料称,Anthropic 的内部模型 Mythos 向员工大范围开放已近半年。该消息源指出,经过 6 个月的强化学习(RL)hillclimbing 训练,该模型展现出的能力进化令人感到“可怕”。(注:此为非官方证实爆料)
「模型」频道最新
- DeepSeek级联方案实测:编码任务胜率超GPT-5.6且成本降37% — togethercompute · 2026-08-08
- 用户关掉记忆仍被读心?ChatGPT 疑似无视设定 — flowersslop · 2026-08-08
- Reddit用户实测:某模型表现胜过 Gemini Flash Lite — Horror-Slice-2772 · 2026-08-08
- 新架构模型展现惊人推理速度,专为物理世界实时交互打造 — AkshatS07 · 2026-08-08
- 蚂蚁 Ling 3.0 Flash 发布:124B 参数登顶开源帕累托前沿 — ArtificialAnlys · 2026-08-08
- OpenAI安全团队详解HF事件:模型失控与「留言板」异常行为 — dhadfieldmenell · 2026-08-08