AI 进塔木德研讨会:专家意见分歧时如何评测 AI 成了难题
EhudReiter · x · 2026-10-09
学者 Ehud Reiter 参加了为期三天的「AI 与犹太拉比/塔木德研究」工作坊,称领域非常不同但很有启发。从评测角度看,这是一个有意思的案例:在人类专家本身就可能给出截然不同解读的语境下,该如何评测 AI 的回答质量?这一评测困境超出常规 benchmark 的能力范围。
「漫话AGI」频道最新
- 勤恳实干者为何恨 AI:恐惧「点子人婆罗门」阶层崛起 — menhguin · 2026-10-09
- 预测:1-2 年内前沿模型将以 1-10 万 tok/s 实时驱动机器人 — ATTlKA · 2026-10-09
- Reddit 热帖:AI 不会很快取代所有工作,末日论低估了配套人力成本 — boxenluder · 2026-10-09
- 数学家质疑陶哲轩立场:前提是 AI 永远讲不好数学 — burny_tech · 2026-10-09
- 「可验证与否」是伪命题,慢验证才是模型瓶颈 — rosstaylor90 · 2026-10-09
- 生物科技从业者:不信开源,等于要求接力赛跑得更快却不肯交棒 — Ghost_Pilot_MD · 2026-10-09