DeepMind 提出 SkillSmith:将模型权重视为可组合模态

Google DeepMind 发表新研究 SkillSmith,探索了一种无需重新训练或盲目合并即可为模型赋予新能力的方法。该框架创新性地将模型权重视为一种额外的模态,让大语言模型能够原生读取。通过这种方式,SkillSmith 能够将模型已掌握的技能与新任务描述动态组合,在推理时灵活调用,大幅提升了模型扩展与能力集成的效率。

2026-08-03 ~ 2026-08-03 · 4 条相关

另有 1 条近重复转述:rohanpaul_ai