前沿推理模型参加法律评论写作竞赛,得分低于人类平均
neuranna · x · 2026-08-20
一项预注册实验让前沿推理模型参与 5 所顶级法律评论的年度写作竞赛。结果显示,AI 得分远低于人类平均水平:在其中四家低于所有通过者,在第五家仅击败一名选手。
「研究」频道最新
- 资金环境迫使研究偏向技术忽视社会影响 — evijit · 2026-08-20
- SPADE 自动生成训练环境,AI 实现持续自我进化 — pliang279 · 2026-08-20
- dots3-note Preview 展示未知环境适应与自迭代能力 — omarsar0 · 2026-08-20
- Critic 优于环境奖励: 隐藏规则游戏案例 — omarsar0 · 2026-08-20
- TEMPO 让同一模型在 actor 与 critic 间切换评估长任务 — omarsar0 · 2026-08-20
- 学者反思强化学习:擅长设限却不利于培养长期能力 — sethlazar · 2026-08-20