DeepMind 提出 SkillSmith:将模型权重视为可组合模态
Google DeepMind 发表新研究 SkillSmith,探索了一种无需重新训练或盲目合并即可为模型赋予新能力的方法。该框架创新性地将模型权重视为一种额外的模态,让大语言模型能够原生读取。通过这种方式,SkillSmith 能够将模型已掌握的技能与新任务描述动态组合,在推理时灵活调用,大幅提升了模型扩展与能力集成的效率。
2026-08-03 ~ 2026-08-03 · 4 条相关
- DeepMind 新论文 SkillSmith:将模型权重视为模态,推理时实现技能组合 — omarsar0 · 2026-08-03
- DeepMind 新论文 SkillSmith:推理时动态组合模型权重与文本知识 — rohanpaul_ai · 2026-08-03
- DeepMind 新论文 SkillSmith:将模型权重变为可组合的技能模块 — eyishazyer · 2026-08-03
另有 1 条近重复转述:rohanpaul_ai