Delip Rao 质疑 Stanford NLP 因利益纠缠不宜当 AI 评测仲裁者
rao2z · x · 2026-09-14
Delip Rao 发长文质疑 Stanford NLP 在前沿 AI 评测中的「独立仲裁者」角色:其学生和教师与被评测的前沿公司存在直接或间接(通过共同投资)的深度财务关联,谈不上独立。他认为构建真正独立的第三方评测机构至关重要,任何单一大学或非营利组织(包括非 Stanford 的机构)完全掌控都会造成单点故障。引用帖中还有人补充:agentic 评测已与 NLP 关系越来越小,本质是规划层面的 AI-Complete 问题。
所属事件:METR 获更多模型访问权,业内呼吁多元评估生态(33 条相关)→
「漫话AGI」频道最新
- AI 资本开支周期成败系于下代模型能否撬动更多 token 消费 — menhguin · 2026-09-14
- Ethan Mollick:远程 AI 时代手机助手 Siri 价值将大减 — emollick · 2026-09-14
- Turing Post 盘点通往递归自我改进的 9 条研究路径 — TheTuringPost · 2026-09-14
- Rob LeClerc 批 p(doom) 泛论:不给条件概率就是思维不严谨 — robleclerc · 2026-09-14
- aiXiv 提案:为 AI 生成研究成果设立无人类作者的发表平台 — tdietterich · 2026-09-14
- AI 涉及论文狂涌 arXiv,Dietterich 提出口试认证与 aiXiv 新机制应对 — tdietterich · 2026-09-14