Kimi k3 的长思考核验表现
teortaxesTex · x · 2026-07-20
这条帖在转评一张关于 moonshot/kimi-k3 的 OpenRouter 截图,核心是在看它对“Jacobian conjecture 反例”这类高难题的长思考与自我核验表现。
截图里提到它会进行很长的推理、会回顾自己先前的判断并核对结论;转评者的观点是:Kimi 的验证能力“比我自己给你的还强”,而且它确实把结果想对了。
「模型」频道最新
- NVIDIA 称 Nemotron 3 Ultra 在 2026 IMO 上拿到 30/42 — NVIDIAAI · 2026-07-22
- OpenAI 传将向美国政界简报下一代模型家族 — kimmonismus · 2026-07-22
- Muse Spark 1.1 在 Text Arena 跑到 1495 分,性价比很突出 — ycombinator · 2026-07-22
- 教授提醒:最先进的大模型正变得无法相互替代 — emollick · 2026-07-22
- 实测吐槽谷歌 Gemini 全家桶:无一款模型能胜任核心工作负载 — bindureddy · 2026-07-22
- 曝某模型支持百万 token 上下文,价格低至 $0.33 — MickeySteamboat · 2026-07-22