ML 研究者警告:一生调参刷 benchmark 易致心理失衡

yunta_tsai · x · 2026-09-07

yuntatsai 指出,许多 ML 研究者的日常是对着数字框 hill-climb benchmark,面对一个说话比自己还聪明的系统,难免出现心理问题。他建议离开屏幕去做难的物理问题,例如风洞实验:计算机能读懂图表,但设计一个能验证复杂现实的风洞实验,比任何前沿模型的推理都难。结论:算力可探索的方向远不止几个 benchmark。

原文链接 →

「漫话AGI」频道最新

更多「漫话AGI」频道 AI 资讯 →