Delip Rao 质疑 Stanford NLP 因利益纠缠不宜当 AI 评测仲裁者

rao2z · x · 2026-09-14

Delip Rao 发长文质疑 Stanford NLP 在前沿 AI 评测中的「独立仲裁者」角色:其学生和教师与被评测的前沿公司存在直接或间接(通过共同投资)的深度财务关联,谈不上独立。他认为构建真正独立的第三方评测机构至关重要,任何单一大学或非营利组织(包括非 Stanford 的机构)完全掌控都会造成单点故障。引用帖中还有人补充:agentic 评测已与 NLP 关系越来越小,本质是规划层面的 AI-Complete 问题。

所属事件:METR 获更多模型访问权,业内呼吁多元评估生态(33 条相关)→

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →