Gemma 模型在黑客任务中表现出缓慢的“爬升”行为
voooooogel · x · 2026-09-01
在对比不同模型的训练表现时,作者发现 Gemma 模型在黑客任务上不会像其他模型那样出现长达 50 步的平稳期,而是更倾向于“爬升”式地获得行为,类似于在测试重写之前先进行测试微调。作者还提供了一个相关的玩具环境链接。
所属事件:开发者开源奖励作弊实验环境并实测 Gemma 3(4 条相关)→
「研究」频道最新
- 群平均马尔可夫链论文更新:融合群论的新方法 — michaelchchoi · 2026-09-01
- Snowflake 新研究:共享 GPU 多模型服务的 Semi-Persistence 方案 — bookwormengr · 2026-09-01
- 研究发现:蒸馏到相近架构效果优于相异架构 — SonglinYang4 · 2026-09-01
- 研究微调如何改变用户对「正常」的认知模型 — voooooogel · 2026-09-01
- 研究员怀疑 SDF 是此前 RL 实验的混淆变量 — voooooogel · 2026-09-01
- 研究员探讨模型不对齐在高维空间的分布特性 — lu_sichu · 2026-09-01