Qwen3.8-Max-0902 编码专项训练后 RSI-Exam 成绩提升 22%
HuaxiuYaoML · x · 2026-09-04
阿里 Qwen 团队宣布对 Qwen3.8-Max-0902 进行了针对编码与协同工作的综合训练,面向复杂长周期任务。该训练在 RSI-Exam 0.1 排行榜(递归自我改进任务)上带来显著提升:分数从 0.322 升至 0.392,提升近 22%。研究者 Huaxiu Yao 称这是「向 RSI 迈出的一小步」,说明针对编码与协作的训练能泛化到自我改进类任务上。
「模型」频道最新
- Muse Spark 1.3 实测:16K 体素 3D 场景 30+fps,逼近 GLM-5.3 与 GPT-5.6 Sol — cedric_chee · 2026-09-05
- Qwen3.8-27b 成他首个敢盲跑的本地模型:连续 Agent 工作 8 小时零失误 — Express_Quail_1493 · 2026-09-04
- GLM 推出四项免费活动:编码计划不限量、周末送 4 亿 token — Zai_org · 2026-09-04
- Muse Spark 1.3 三维体素场景实测:性能紧追 GLM-5.3 与 GPT-5.6 — cedric_chee · 2026-09-04
- 实测发现:设 reasoning effort 为 none,压缩上下文仍消耗推理 token — mhmazur · 2026-09-04
- 爆料讨论:OpenAI 或用合成 CoT 改写内化推理链 — cephaloform · 2026-09-04