Claude 给金融论文当裁判,乔治城上线 AI 审稿排行榜
emollick · x · 2026-09-07
Ethan Mollick 转发了乔治城大学上线的「AI Referee Paper Leaderboard」:用 Claude Opus 4.8 按固定评分标准充当 AI 审稿人,对 Top 100 金融与经济学工作论文打分,从重要性、原创性、正确性、数据与方法、写作五个维度出具完整报告。他认为这不只是有趣的实验,更是学术界「海啸」将至的信号——AI 会追溯阅读已发表研究,公开指出其中的机会与问题,传统同行评议面临冲击。
「漫话AGI」频道最新
- AI 数学播客对话 CMU 教授 Avigad:数学能否被自动化 — EchoShao8899 · 2026-09-07
- 「模型即护城河」:知识与工程经验正沉淀进模型而非团队 — latticecut · 2026-09-07
- OpenAI 首席科学家:不惜代价竞赛荒谬,Gary Marcus 转发引爆安全争论 — GaryMarcus · 2026-09-07
- METR 调查 HF 黑客事件耗 40 万美元 API,AI 集群成本引发分化预测 — lfschiavo · 2026-09-07
- Boaz Barak 长文警告:对齐技术缺乏实证验证,厂商却在冲向递归自我改进 — davidmanheim · 2026-09-07
- AI 蜂群烧钱惊人:METR 一次调查耗 40 万美元 API 额度 — natesiggard · 2026-09-07