美英政府测试称 Kimi K3 明显落后美国前沿模型
Polymarket · x · 2026-07-24
Polymarket 转述称,美英政府测试发现月之暗面 Kimi K3 的表现“显著低于”美国前沿模型。
这不是官方基准发布,但它指向的是一项具体模型在政府测试中的对比结论,属于值得关注的模型表现信息。
所属事件:英美安全机构联合评测:Kimi K3 网络安全能力落后前沿模型(5 条相关)→
「模型」频道最新
- Bindu Reddy 称 Kimi K3 便宜、擅长长任务,但还不是前沿模型 — bindureddy · 2026-07-24
- Will Depue 说,GPT-5.6 Pro 比 Codex 更会挑错和修正 — willdepue · 2026-07-24
- Artificial Analysis 街头广告牌公开模型智能与成本前沿 — ArtificialAnlys · 2026-07-24
- Grok 4.5 已在网页和移动端全面开放给所有账号 — Ready-Independent108 · 2026-07-24
- Laguna-S-2.1 的无限思考循环可能是量化导致的 — CautiousStudent6919 · 2026-07-24
- 用户用几周后取消 Claude Max:问题不是聪明,而是太道德化 — breath_mirror · 2026-07-24