争议:Anthropic 力推 METR 被指监管俘获,CoT 审计方法遭质疑
sarahbmyers · x · 2026-09-14
Heidy Khlaaf 指控 Anthropic 推动「监管俘获」:其力推的第三方审计机构 METR 在意识形态与资金上均有利益关联,且审计方法不科学——依赖链式思维(CoT)等手段并选择性采信证据,以强化 AGI 叙事。
sarahbmyers 补充指出,问题不止于这份评测提案的结构被利益方把持,连评测方法本身也已被污染:单纯增加更多 METR 式评测无济于事,行业需要的是真正稳健、科学的 AI 能力测量体系。
所属事件:METR被指监管俘获,CoT审计方法遭质疑(4 条相关)→
「模型」频道最新
- Astra Python 用法惊艳,博主称 V4.1 Flash 是「proto-AGI」 — teortaxesTex · 2026-09-14
- Ollama 联合创始人:小模型已能胜任大多数对话与推理场景 — ollama · 2026-09-14
- 用户吐槽 GLM Flash 5.3 输出频繁滑回中文 — DevDminGod · 2026-09-14
- AI 攻克纳维-斯托克斯千年难题,OpenAI 两周内训出数学跃迁模型 — TheZvi · 2026-09-14
- Embedding 只用来做检索?作者盘点被浪费的隐藏能力 — ProposalOrganic1043 · 2026-09-14
- 让模型用 Python 代码作画,V4.1 Pro 展现惊人编程审美 — teortaxesTex · 2026-09-14