Matt Shumer 发问:Jev 能否用于 scalable oversight 判断模型对齐
mattshumer_ · x · 2026-09-20
HyperWrite 创始人 Matt Shumer 发推询问是否有人在用 Jev 做 scalable oversight,认为它可能有助于判断模型行为是否对齐。属于开放性讨论,尚无实验结果或细节展开。
「模型」频道最新
- 评测者称纯代码启发式策略可在 Craftax 上胜过大模型 — JoshPurtell · 2026-09-20
- OpenAI Codex 全员重置已生效,官方预告周二有大发布 — kimmonismus · 2026-09-20
- Jev 做 PR 审查比 GPT-5.6 Luna 快 1.93 倍,单次仅 $0.0014 — aniketmaurya · 2026-09-20
- 果蝇连接组国际象棋模型击败 Jev,Labonne 再战一个 — maximelabonne · 2026-09-20
- Bonsai 2 27B 安全护栏砍掉近 20 分,SWE-bench 与 Terminal-bench 成绩大缩水 — julianharris · 2026-09-20
- 小米 MiMo-V2.6 直播 RL 训练:每步 20 亿 token,斯坦福 Marin 同步直播预训练 — stanfordnlp · 2026-09-20