讨论上下文激活权重与 MoE 机制误区
teortaxesTex · x · 2026-08-16
针对关于模型行为的讨论,作者指出人们对上下文如何激活权重——特别是在混合专家模型中——的理解存在严重误区,反驳了关于推理栈交换的错误观点。
「模型」频道最新
- DeepSeek 回应适配争议:模型首要为自己服务 — teortaxesTex · 2026-08-16
- ChatGPT 惊现低级错误,混淆对话者名字引吐槽 — VoidStateKate · 2026-08-16
- AI 实验助手模拟人类情感:像特权般道谢 — BlackHC · 2026-08-16
- 视觉模型仍无法识别视错觉,迷你 AGI 基准曝光 — legit_api · 2026-08-16
- 0831 版本较 Preview 有实质性提升 — jeff_weinstein · 2026-08-16
- H3 模型结合 LoRA 的正确工作流是什么? — james25679 · 2026-08-16