Kimi K3 在 OpenRouter 上吞吐升至 49 tok/s
cedric_chee · x · 2026-07-28
Kimi K3 在 OpenRouter 上的吞吐据称从 19 tok/s 飙到 49 tok/s。
发帖人还观察到一个行为特点:K3 会把不少推理预算花在自我否定和反复修正上,经常出现类似“Wait, actually...” 的回头重算。帖子引用的性能对比则把 K3 与 GLM-5.2 放在一起看。
「Infra」频道最新
- SovereignAI 称 Qwen3.5-397B 仅用 45 万美元算力逼近 Opus 4.8 — schwarzjn_ · 2026-07-28
- 季度增长压力下,云和 AI 价格可能继续上行 — DavidLinthicum · 2026-07-28
- 推理算力成本持续骤降,AI 安全论坛警告「氛围黑客」威胁 — joshua_saxe · 2026-07-28
- llama.cpp 新增 Kimi-K3 文本模型本地推理支持 — ilintar · 2026-07-28
- 有人直言向量嵌入数据库潮流正在伤害搜索 — davidmanheim · 2026-07-28
- 苹果市值重回全球第一,超过 Nvidia 达 4.938 万亿美元 — mitchdeg · 2026-07-28