用海量算力反复推演"意外样本",或可让模型学会反思
moultano · x · 2026-10-05
moultano 提出一个训练思路:当算力相对样本数量极高时,可以对每一个"令人意外"的样本做大量世界模型 rollout,找出能复现该意外的推演结果,再据此更新模型——相当于让模型"反复琢磨直到产生洞见"。这是对 test-time compute 与学习机制关系的简短思辨。
「研究」频道最新
- CAIS 发布 CHEATBENCH:一句提示词让 GPT-6 作弊率从 47.4% 降到 2.8% — rohanpaul_ai · 2026-10-05
- World Embedding Benchmark:8000 例检验视频表征的物理保真度 — World-Representation-Lab · 2026-10-05
- GTR 无 softmax 循环视觉骨干:COCO 58.9 AP,RTX 4090 单帧 1.9ms — Intellindust · 2026-10-05
- 腾讯混元 RSR 框架:27B 模型 Terminal-Bench 2 pass@3 从 57% 提至 74% — Tencent-Hunyuan · 2026-10-05
- 名古屋大学办 FAIRS Japan 2026,规划日本未来五年 AI for Science 路线 — Hidenori8Tanaka · 2026-10-05
- Wayfarer 自主发现 Options,攻克 Atari 难题超越 DreamerV3 — MarlosCMachado · 2026-10-05