前沿模型藏思维链+蒸馏失效,开源与闭源差距恐持续拉大
toptickcrypto · x · 2026-09-29
引用 @FundaAI 指出:Anthropic、OpenAI、Google 最新模型已不再以明文暴露完整思维链,蒸馏越来越难奏效,开源权重开发者需要自己投入强化学习、合成数据生成和训练环境,而这些都需要算力。
主帖补充判断:前沿实验室内部能力在加速,同时西方实验室部署的有效算力是中国实验室的数倍,闭源与开源权重模型的差距会继续拉大。
核心论点是一条因果链:CoT 不透明 → 蒸馏路径受阻 → 开源阵营只能靠自建 RL/数据管线追赶 → 算力差距被放大为模型差距。
「模型」频道最新
- Anthropic 发布 Sonnet 5.5,实测建站与财务表分析 — Rasmic · 2026-09-30
- Jev 新模型类型:千次打标成本低于一次 GPT-5.4 调用 — ivan_bezdomny · 2026-09-30
- DeepSeek Harness 桌面版发新版,下载送 6 元免费额度 — teortaxesTex · 2026-09-30
- 爆料称 OpenAI 将发更强模型 Bel,Anthropic 则止步于 Fable — eyishazyer · 2026-09-30
- NVIDIA开源3B视觉定位模型,号称比Qwen3-VL快10倍 — Dan_Jeffries1 · 2026-09-30
- Codex 订阅风波之际,用户调侃 Opus「回归即常驻」 — generativist · 2026-09-30