Kimi K3 对比 Grok 4.5:谁能更好补全草图?
CodeByPoonam · x · 2026-08-06
开发者进行了多模态模型的能力实测,要求 Kimi K3 和 Grok 4.5 独立完成同一张未画完的草图。测试直观展示了不同模型在图像理解和续写生成上的表现差异。
所属事件:Kimi K3 与 Grok 4.5 草图补全实测对比(2 条相关)→
「模型」频道最新
- AI学者质疑 ARC-AGI 评测含金量,称评估模型时已很少参考其得分 — arankomatsuzaki · 2026-08-06
- DeepSeek被曝成本并不低,低价或为策略性补贴 — DanielLockyer · 2026-08-06
- DeepSeek-V4-Flash 发布:304B 参数跑赢更大模型,API 定价仅 $0.14 — JeremyCMorgan · 2026-08-06
- LMSYS Arena上线AutoEval:基于奖励模型实现发布即评测 — arena · 2026-08-06
- DeepSeek与Kimi登顶OpenRouter特定任务真实花费榜 — rohanpaul_ai · 2026-08-06
- 多模态预训练机制探究:视觉与语言的协同与竞争 — heghbalz · 2026-08-06