不训练不加数据:强模型设计工作框架让小模型 0.488 提到 0.912
jiqizhixin · x · 2026-09-08
UIUC 与 Salesforce AI 提出测试时的 AI4AI 方法:不给小模型训练或加数据,而是让强模型为它设计一套工作框架(harness),能力迁移发生在推理时的组织方式上。
核心思路:模型本身不变,系统能力一半在大脑、一半在大脑被如何组织——
- 复杂任务自动分类分派
- 易错部分交给计算器
- 长期记忆存于表格
- 固定规则固化为程序
- 用 checklist 防格式错误
主实验中,GPT-5.4-mini 在强模型设计的框架下平均准确率从 0.488 跃升至 0.912,接近翻倍。
「研究」频道最新
- FactoSR:用强化学习分解 4D 属性提升空间推理 — HKUST-GZ2 · 2026-09-08
- 斯坦福团队研究:通用编码 Agent 已碾压手工数据 Agent 达 37 分 — CShorten30 · 2026-09-08
- Dhenu Vision 1.0 公开基准:参考图精确率 94.4% 超所有通用模型 — DevDminGod · 2026-09-08
- NBER 论文:自动化在取代岗位前,先偷走工作的意义 — ArtificialOther · 2026-09-08
- 单卡两天从零训出 441M 参数文生图模型:无 VAE 无文本编码器 — ostrisai · 2026-09-08
- 41.7 万参数 RNN 从单一初始状态自生成 6500 帧 Bad Apple — SEBADA321 · 2026-09-08