有人猜测该模型先蒸馏 Opus 再靠后训练刷榜
LucaAmb · x · 2026-07-23
评论者猜测,这个模型可能先从 Opus 蒸馏而来,再通过后训练把基准分数继续“刷”上去。
他还补充说,后训练微调往往非常省时,因此表面上的能力跃升,可能主要来自蒸馏之后的进一步优化。
「模型」频道最新
- 中国 AI 模型占美国公司 token 使用量 60% — SumitGup · 2026-07-23
- 有人在问 Kimi 的中文推理是否强于英文 — amyxlu · 2026-07-23
- 开发者发现 Claude 3 Opus 智能体存在无限分裂与上下文循环 — bdsqlsz · 2026-07-23
- 用户反馈 Gemini 严重失忆:上下文断裂并频发语言混乱 — crimsonhn · 2026-07-23
- 用 Codex 智能体梳理开源生态,发现 Mask2Former 已落后 SOTA — NielsRogge · 2026-07-23
- 每日看板显示开源模型采用仍由中国和 Qwen 领跑 — natolambert · 2026-07-23