Laguna-S-2.1 败在 100 米步行决策测试
logic_prevails · reddit · 2026-07-23
Laguna-S-2.1 连“走 100 米还是开车”都答得像在做严肃决策
发帖人拿 Laguna-S-2.1 做了一个很简单的常识测试:离洗车店只有 100 米,该走路还是开车。模型给出的回答是:通常步行最简单、最实际,除非有天气、安全、无障碍等特殊因素。
发帖人同时对比了 Qwen3.6-27B Q4,表示后者顺利通过了这个提示。整帖更像是一次轻量的 sanity check,用来怀疑问题究竟是量化带来的,还是模型本身就没过基础智力测试。
「模型」频道最新
- Kimi-K3 被估算为 50.4B 激活参数 — StefanoGogioso · 2026-07-23
- 指控称 Moonshot 为 Kimi K3 蒸馏 Anthropic 模型 — wavefnx · 2026-07-23
- PeptiVerse 发布肽溶解度与毒性预测新模型 — ahandvanish · 2026-07-23
- fdtn-ai 1B 文本模型在 Hugging Face 热门榜走红 — fdtn-ai · 2026-07-23
- Qwen 3.6 跑分对比 170HX、RTX 5090 和 RTX PRO 6000 — simplefunction · 2026-07-23
- 有人说 GPT-5.6 Sol Medium 已成自己最常用模型 — MatthewBerman · 2026-07-23