为什么 Sonnet 5/Opus 5 体感不如 GLM 5.3?播客热议蒸馏的价值边界
baseten · x · 2026-09-12
Dwarkesh Patel 转发推荐其播客片段:嘉宾 John、Beren 与 Charlie 探讨为何 Sonnet 5 和 Opus 5 用起来感觉不如 GLM 5.3——尽管 Anthropic 理论上可以从内部模型 Fable 做原始 logit 蒸馏,也能在 Fable 的训练环境上训练自家模型。讨论延伸到蒸馏的真实价值:如何有效做蒸馏、哪些模型行为难以通过蒸馏迁移。
「模型」频道最新
- 继续预训练 vs RAG:Qwen 3.5 4B 知识内化实测对比 — funJS · 2026-09-12
- DeepSeek 应用悄悄上线 4 种语音,自研 TTS 模型或在路上 — testingcatalog · 2026-09-12
- 实测 OpenAI Astra 无缝操控浏览器,作者追问「手机操作何时解决」 — infoxiao · 2026-09-12
- 研究员推测模型空间推理跃升源于 Blender 训练数据 — yoavartzi · 2026-09-12
- Sakana Fugu Max 上线 OpenRouter:多智能体编排,1M 上下文 $2/$6 定价 — SakanaAILabs · 2026-09-12
- 用户怒斥 Astra 发布仅两三天即被降智:Twitter 全炸了 — Significant-Ad6970 · 2026-09-12