METR 悄悄上线 Notes 页:未打磨的智能体安全与递归自改进研究宝库
dejavucoder · x · 2026-09-29
dejavucoder 发现评测机构 METR 有一个少有人知的 Notes 页面,专门发布未经打磨的研究简报与推测,内容极有料:
- Per-Action Monitor 评测安全:为更安全的评测实现并评估基础的逐动作拦截监视器,列明其有效所需的前提主张与证据缺口(2026-09)。
- 发现是否在加速:检视网络、数学、算法领域的公开时间序列,看 LLM 是否加快了发现速率(2026-08)。
- 智能体能力度量:综述随支出与相对人类表现变化的 agent 能力比较指标(2026-07)。
- 递归自改进经济学:建模 AI 加速 AI R&D,反馈效应能否强到自持加速(2026-07)。
- Anthropic 研究者提效可能 >2x:由「贡献者日均合并代码量 8 倍」出发,在标准经济学建模下推断编码智能体对个体研究者的提效超过 2 倍(2026-07)。
- NanoGPT speedrun 证据:对人类与 agent 贡献分类,考察公开挑战对 AI R&D 加速的指示。
- CoT 可控性微调实验:少量指令遵循微调可泛化到 CoT 的有意义的可控性。
「研究」频道最新
- 机器人评测平台 Manifold 开放早期访问,30 分钟跑千次 GPU 并行 rollout — paigeinsf · 2026-09-30
- 千个 AI 智能体 24 小时自动发现病毒中类 CRISPR 新基因系统 — CurieuxExplorer · 2026-09-30
- 470万条解释实验:只审计5%的token位置即可发现prompt注入威胁 — aisilab · 2026-09-30
- 南洋理工 PerF:像素空间扩散DiT按特征分层精炼,FID低至1.63 — NanyangTechnologicalUniversity · 2026-09-30
- IBM提出Q&D训练法:智能体主动追问所需信息,胜过15倍大模型 — ibm · 2026-09-30
- 研究者预测:AI 将速通数学猜想,转向材料与药物发现 — tak3sh8 · 2026-09-30