威斯康星教授吐槽:X上爆火的后训练算法开箱即用概率仅5%
Kangwook_Lee · x · 2026-09-16
威斯康星大学 Kangwook Lee 教授发推吐槽:X 上爆火的新后训练算法在自己的 LLM 训练中开箱即用的概率约为 0.05。他指出,自约十年前人们指出 RL 可复现性问题以来,这一状况几乎没有改变,并附上了相关讨论链接。
「研究」频道最新
- CoLLAs 2026 报告:记忆或不可消除,数据策展/遗忘/剪枝是关键策略 — gkdziugaite · 2026-09-16
- ETH Zürich 让机械手用手指自己走路,类人五指突破四足步态范式 — lukas_m_ziegler · 2026-09-16
- Genome Biology 征稿:肿瘤微环境的多组学与AI方法研究 — arjunrajlab · 2026-09-16
- 谷歌工程师造 WikiSkill:把 Agent 执行历史编译成可复用技能 — blaizedsouza · 2026-09-16
- 网友立赌约:明年底前 AI 将助力发现新物理学 — blaizedsouza · 2026-09-16
- FiCA 论文:单张人像照片秒生成可驱动的高斯 Codec 虚拟形象 — rsasaki0109 · 2026-09-16