GLM 在随机上下文中答非所问,疑似 user/system 角色混淆
eliebakouch · x · 2026-09-17
Hugging Face 研究者 eliebakouch 分享了一个模型行为观察:在随机上下文测试中,GLM 给出了奇怪回答;他推测是 Astra 把 user 和 system 角色搞混了,并吐槽这看起来很蠢,还澄清测试并非故意构造 OOD 场景。
属于对模型角色处理鲁棒性的零散观察,细节有限。
「模型」频道最新
- 神秘模型 'Union Alpha' 傲居 DeepSWE,性能直逼 GPT-6 级、价格堪比 DeepSeek — daniel_mac8 · 2026-09-17
- 黄仁勋:AI 领导力不属于少数公司,开源闭源都重要 — NVIDIAAI · 2026-09-17
- 神秘模型 Jev 概率校准出色:基准平均误差仅 1.74 个百分点 — hackgoofer · 2026-09-17
- 研究员筛选合成环境:Qwen 必败而 GLM5.3 能解,发现有趣行为倾向 — kalomaze · 2026-09-17
- 为何 2026 年还留非思考模式?CoT 监控与性能双双要推理 — scaling01 · 2026-09-17
- 开发者自建实时语音模型对比表,六家轮次机制一查便知 — mahimairaja · 2026-09-17