新评测探索:AI自创问题引发多模型答案分歧

HazanPrinceton · x · 2026-08-02

研究者 Sanjeev Arora 分享了一项有趣的 AI 评测新思路:让 AI 模型自主生成带有明确标准答案的问题,然后再交由其他模型解答。这种测试方法旨在衡量超越人类常规认知尺度的智能,并发现不同模型在面对这些机器生成的问题时,往往会给出截然不同的答案。

原文链接 →

「研究」频道最新

更多「研究」频道 AI 资讯 →