Kimi K3 与 GLM 5.2 潜力前瞻:强化学习或带来性能飞跃
airesearch12 · x · 2026-07-31
AI 研究者指出,当前看到的 Kimi K3 和 GLM 5.2 等模型仍处于基础模型阶段。参考 Google 通过后训练大幅提升 Gemini V4 Flash 性能的案例,这些新模型预计还需要至少 3 个月的强化学习(RL)训练。随着后续 RL 训练的深入,它们的实际性能有望被推向全新的高度。
「模型」频道最新
- GPT 5.6 Luna 性价比反超:比 Google 最强更聪明,比最便宜更便宜 — Rare_Bunch4348 · 2026-07-31
- DeepSeek 编程成本仅 GPT Luna 三分之一:实测算力与 Token 消耗账本 — auto_off · 2026-07-31
- 中国大模型崛起:性能比肩美国旗舰,成本大幅领先 — repbre · 2026-07-31
- DeepSeek-V4-Flash 仓库惊现 Hugging Face,支持百万 Token — NielsRogge · 2026-07-31
- 实测 DeepSeek-V4-Flash 智能体:3D 任务成本仅 0.07 美元 — cedric_chee · 2026-07-31
- DeepSeek-V4-Flash-0731 模型权重正式开源发布 — shing3232 · 2026-07-31