Kimi K3 用了两小时和 30 美元,还是没做出填字游戏
Kurk_Lazaris · reddit · 2026-07-28
一位 Reddit 用户称,Kimi K3 在一个看似简单、但其实有多层约束的任务上表现很差:生成填字游戏(crossword)。
- 他们花了 2 小时、30 美元 试图让模型完成任务。
- 结果模型对填字游戏的算法逻辑、题目描述和网格约束都理解错误。
- 生成出来的格子里,很多单词根本无法正确交叉。
- 发帖者也在问:这究竟是一个对顶级模型都很难的任务,还是 Kimi K3 这类模型在结构化推理上还有明显短板。
「模型」频道最新
- 老 Web 开发者称 Claude Opus 4.8 和 5 聊天已难用 — FuzzyHead455 · 2026-07-29
- 用户称 Gemini Pro 付费后仍被分流到其他模型 — IAmMonke2 · 2026-07-29
- Reddit 争论 Hugging Face/OpenAI “AI hack” 是否可信 — callme_e · 2026-07-29
- 一组假 Claude 截图把“模型福利”写成了 AI 圈名场面 — repligate · 2026-07-29
- ChatGPT 安卓版疑似把模型切换改成 effort 等级 — justanothergin · 2026-07-29
- 伪造 Claude 截图变成超立方体纠错梗图 — repligate · 2026-07-29