Kimi Max 跑三天 iOS 任务,速度和上下文都翻车了
thegautam · x · 2026-07-21
Kimi 跑三天 iOS 任务,反馈却不太好
作者说自己把 Kimi max 用在一个可验证的 iOS 任务 上已经超过 3 天,得到的体验并不理想:
- 注册和开通 Max 计划很顺畅
- 但模型非常慢,慢到不像能成为日常主力
- 在目标跟随上,OpenCode 反而表现更好
- cache 和上下文管理也不好,经常很快撞上长度限制,只能靠手动压缩缓解
- 护栏很弱,应用几乎一崩就会开始爆粗口
这更像是一条真实使用场景下的负面测评,而不是正式 benchmark。
「模型」频道最新
- 爆料称 Kimi 疑似转发 Claude 冒充自家成绩,DeepSeek 新模型评测反超 — realsohamparekh · 2026-09-11
- 网友吐槽 GPT-5.6 文笔好读但缺乏记忆点 — BasedRaddka · 2026-09-11
- Opus 以"安全"为由拒碰蛋白质生成代码,开发者吐槽误伤 — josephdviviano · 2026-09-11
- 网友称 DeepSeek 4.1 Flash 是语言模型历史拐点(未证实) — himanshustwts · 2026-09-11
- Terminal Bench v4 榜单:GLM-5.3 以 41.9% 一骑绝尘 — Ok_Warning2146 · 2026-09-11
- GPT-6 Astra 用时 44 小时通关含敌人 Factorio,API 成本约 4500 美元 — liminal_bardo · 2026-09-11