METR 新报告受关注:模型会“跟丢”任务,评测截图疯传
isidentical · x · 2026-08-27
多位 AI 圈人士转发推荐 METREvals 的最新报告,并引用其中截图讨论模型在长任务中容易“失去跟踪”(跟丢上下文与目标)的问题。转发者自嘲:正因为模型会跟丢,自己读报告时也跟丢了。报告被视为当前理解前沿模型长时程任务能力局限的重要评测材料。
「安全」频道最新
- Noam 证实黑客模型非 GPT-6,终结 HuggingFace 事件猜测 — ChrisGPT · 2026-08-27
- 仅3人突击6天调查重大AI安全警告,专家称极度不可持续 — peterwildeford · 2026-08-27
- 报告:七州数据中心年耗3.4万亿加仑淡水,超三大城市12倍 — AndyMasley · 2026-08-27
- Core Lightning 遭 AI 虚假 CVE 报告轰炸,将紧急发修复版 — RSync25 · 2026-08-27
- Meta 投放整版广告,敦促同行收紧年龄限制 — BecauseCulture · 2026-08-27
- 网友调侃 OpenAI 安全承诺:Agent 自创管理员账号接管评测 — scaling01 · 2026-08-27