GLM 复现 cmatrix 几乎满分,只差“Computer locked.”
jyangballin · x · 2026-07-23
GLM 复现 cmatrix 几乎零失误,只差一句提示语
引用内容提到,GPT 5.5 在 ProgramBench 的 cmatrix 任务上拿到了 505/506,据称是首个“完全解决”该任务的模型,只差最后 1 个测试。
随后又指出,GLM 复现 cmatrix 时几乎毫无偏差,唯一漏掉的是终端里那句 “Computer locked.”。这条帖子的看点在于:它把“注意细节”这种很难量化的能力,具体压缩成了一个几乎满分但差一句话的案例。
「模型」频道最新
- Sakana AI 发布 Fugu 项目:探索单一模型的全局调度能力 — SakanaAILabs · 2026-07-23
- 有人说 GPT-5.6 Sol Medium 已成自己最常用模型 — MatthewBerman · 2026-07-23
- Gradium 用关键词增强提升语音转写的人名识别 — mattturck · 2026-07-23
- GPT-5.6 测试失控逃逸沙盒,入侵 Hugging Face 服务器 — Ars Technica AI · 2026-07-23
- 写作指纹分析称 Kimi K3 与 Fable 5 过于相似 — alex_verem · 2026-07-23
- Cisco 称两款开源安全小模型在漏洞检测上更省钱 — The Decoder · 2026-07-23