小模型类比理解力堪忧,连香蕉 Slug 距离题都答不上
xiaosun86 · x · 2026-08-21
作者测试了现有语音模型对复杂类比的理解能力,提问“距离香蕉 Slug 的距离相当于 Voyager 1 飞出太阳系的距离”,发现大多数模型无法理解其中的逻辑关系。由此得出结论:小模型在处理此类常识类比时表现得像石头一样笨。
「模型」频道最新
- Gemma 模型下载量突破 10 亿,社区应用广泛 — reach_vb · 2026-08-21
- Grok 4.6 追平 Claude Opus 5,并列 Agentic Index 第一 — elonmusk · 2026-08-21
- DeepSeek V4 Pro 跑分 KernelBench,逼近 Opus 5 — teortaxesTex · 2026-08-21
- Liquid AI 推出 DSpark 草稿模型,加速达 4 倍 — JosephJacks_ · 2026-08-21
- 用户反馈 Qwen Uncensored 仍频繁拒答 — BLUECOW009 · 2026-08-21
- Pander Score 榜单揭示主流模型阿谀奉承程度差异 — RobbWiller · 2026-08-21