对 k3 的使用印象讨论
AaronBergman18 · x · 2026-07-17
作者在问大家对 k3 的实际体验如何。 他补充说,自己最近评估了很多 LLM,面对一个成本很高的任务后,越来越相信“开权重模型已经被基准测试刷满”的观点;相比之下,Sonnet 5 在这类任务上比更便宜的公开模型强得多,但他也保留了“这次也许会不同”的判断。
所属事件:Kimi K3编码实测接近前沿但体验欠佳(3 条相关)→
「模型」频道最新
- 中国模型在 OpenRouter 上领先 — JOBhakdi · 2026-07-20
- AI解RH会被区别对待的段子 — tak3sh8 · 2026-07-20
- 泄露称 GLM-5.5 可能8月发布 — teortaxesTex · 2026-07-20
- Gemini 出现奇怪崩坏 — windowssandbox · 2026-07-20
- Hermes 发布桌面与路由大更新 — Teknium · 2026-07-20
- 100万上下文未必更实用 — mattpocockuk · 2026-07-20