研究显示蛋白语言模型最深层并非总是最优
anshulkundaje · x · 2026-08-17
一项针对 13 个蛋白语言模型(PLM)的研究系统性地表明,直接使用最后一层嵌入往往并非最佳选择。在 15 个下游任务中,只有约 17.9% 的情况下最深层表现最好,许多蛋白级任务的表现峰值出现在中间层,随后在末端衰减。研究通过训练线性探针和 k-NN 探针,绘制了模型内部不同层级的信息分布图,揭示了残基级任务通常随深度单调提升,而蛋白级任务则呈现不同的趋势。
「研究」频道最新
- 研究:o3-mini 在智能体循环中生成高质量考题 — mattbeane · 2026-08-17
- SebLague 开源数字逻辑模拟器,可视化计算机底层原理 — tom_doerr · 2026-08-17
- LLM长任务失败源于“认知惯性”,RL可修复 — burny_tech · 2026-08-17
- LLM 跨语言安全护栏退化原因:模型反而更易在英语失效 — zeeshanp_ · 2026-08-17
- 机器学习编程实战:验证数学理论之美 — Negative_War_65 · 2026-08-17
- GWAS 研究:二十年后 CD40 位点终于揭示因果变异 — anshulkundaje · 2026-08-17