Kimi K3 游戏设计能力实测优于 GPT-5.6 Sol
goyalshaliniuk · x · 2026-07-20
作者使用相同的设计提示词,对比了 Kimi K3、GPT-5.6 Sol 和 Fable 5 三款模型在游戏设计中的表现,主要评估了节奏把控、设计直觉和游戏手感。
结果显示,Kimi K3 表现最佳(9.5/10),具备出色的设计直觉,节奏与玩法都很扎实,且单次成本仅 $0.03。相比之下,Fable 5(7.5/10,$0.38)和 GPT-5.6 Sol(7/10,$0.11)在节奏推进上显得过快。
「模型」频道最新
- 新基准一出分数暴跌 70 点:「刷榜」现象如何让跑分失真 — airesearch12 · 2026-09-11
- ChatGPT 竟劝用户「问题太复杂,去试试更笨的回答」 — phido3000 · 2026-09-11
- 有人要建全模型基准分数汇总页 — airesearch12 · 2026-09-11
- 爆料称 Kimi 疑似转发 Claude 冒充自家成绩,DeepSeek 新模型评测反超 — realsohamparekh · 2026-09-11
- 网友吐槽 GPT-5.6 文笔好读但缺乏记忆点 — BasedRaddka · 2026-09-11
- Opus 以"安全"为由拒碰蛋白质生成代码,开发者吐槽误伤 — josephdviviano · 2026-09-11