观点:扩展推理与后训练或助Qwen登顶

LegacyRemaster · reddit · 2026-09-02

作者认为扩展推理和后训练是 DeepSeek、Qwen 和 GLM 提升性能的关键。鉴于 Qwen 4 尚未发布,作者对未来模型持乐观态度,认为带有“印记”特性的模型可能很快在特定任务上匹配或超越 2.4T 参数的模型。

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →