一天实测Kimi K3:上限高但代价大
Tarandjpop · reddit · 2026-07-21
一天实测 Kimi K3:上限高,但代价也高
作者给出的总体印象是:如果让 Kimi K3 充分思考,它经常能拿到这一批里最好的结果,尤其在视觉审美和整体打磨上很强。但这种优势伴随很重的使用代价。
主要结论
- 推理几乎是强制的:最大推理不能关闭,且会吃掉大约 73%–83% 的输出预算。
- 图片任务很慢:有些图像任务要跑 50–60 分钟 推理,长到会触发连接限制。
- 名义便宜,实际昂贵:表面上的 $3/$15 定价看起来很香,但由于推理 token 消耗巨大,单次成功任务的实际成本会到 Opus 的 2–3 倍。
- 基础设施压力大:它需要流式输出、10 万到 16 万 token 的预算,以及小时级连接存活时间,迫使团队重构整套栈。
- 需求过热:高峰期 429 很频繁,真正成功的两次运行都发生在低峰期。
总结就是:K3 的上限确实高,但可用性和基础设施要求都相当苛刻。
所属事件:实测 Kimi K3 输出上限高但推理成本远超 Opus(2 条相关)→
「Infra」频道最新
- NVIDIA 称 Nemotron 3 Ultra 在 RTL 芯片设计任务上达 97.1% — NVIDIAAI · 2026-07-27
- 本地 Qwen 模型驱动机械臂测试 78 款手机续航 — gappyvalley · 2026-07-27
- MiniBot 2.40 新增 xAI、HF Studio 和 vLLM 支持 — Creative-Type9411 · 2026-07-27
- 苹果智能眼镜、英伟达SK合作与携程51.79亿罚单汇总 — APPSO · 2026-07-27
- DeepSeek 融资传闻、欧盟 AI 透明度规则与 OpenAI 安全事故 — 创业邦 · 2026-07-27
- QuixiCore 主张原生量化内核取代先反量化再执行 — QuixiAI · 2026-07-27