蒸馏有两条路:抓原始 CoT 高风险,任务输出训练才低风险
JoshPurtell · x · 2026-09-03
在关于大厂是否互相蒸馏的讨论中,JoshPurtell 提出区分两种「蒸馏」定义:其一是越狱 API 获取模型原始思维链后照抄,其二是让模型在开发环境完成任务、再用其工具调用或非推理输出训练。这一区分构成后续关于蒸馏可行性与风险的争论起点。
所属事件:JoshPurtell 拆解模型蒸馏之争:任务类型决定风险与可行性(8 条相关)→
「模型」频道最新
- 曝 OpenAI 秘密采用不外显思考的 loop transformer,Astra 传为循环模型 — realDanFu · 2026-09-03
- 研究者:Fable 模型已胜过最好的 CS 教授,大学教育被绕开 — generativist · 2026-09-03
- 「不拿你数据训练」难取信,开发者转向开源模型保隐私 — adityaag · 2026-09-03
- NVIDIA 成 Hugging Face 开源仓库最多厂商,一年新增超 500 个 — Sam_Witteveen · 2026-09-03
- GLM 5.3 达 200+ TPS,37 秒为个人网站新增完整页面 — nutlope · 2026-09-03
- 同 prompt 实测:fable 5.1 与 sol 5.6 三.js 瀑布生成对比 — majidmanzarpour · 2026-09-03