ML评测文化变迁:90年代无论文带基准,如今无基准难发论文
abursuc · x · 2026-09-16
#ssad2026 演讲片段:Kashyap Chitta 回顾机器学习评测框架的历史——1990 年代几乎没有论文带基准测试,而 2020 年代没有基准的论文几乎无法发表;共同测试框架的建立过程不易,但多年后的进展令人印象深刻。
所属事件:SSAD2026研讨会聚焦自动驾驶评测与开源浪潮(5 条相关)→
「研究」频道最新
- ModularRSI:模块化框架让智能体外壳实现可泛化的递归自我改进 — IQuestLab · 2026-09-16
- 跨厂商 3.1 万次实验:特定提示词令 11 个模型全部返回零字节输出 — rayanpal_ · 2026-09-16
- 机器人团队将开源 GALATEA 等 3 项灵巧手控制成果 — ChongZzZhang · 2026-09-16
- CARLA 元老 Ros 分享合成数据加速自动驾驶研发 — abursuc · 2026-09-16
- 评 AI 该像评同事:FrontierAgent 开源框架顺势而起 — aakashgupta · 2026-09-16
- CoLLAs 2026 报告:记忆或不可消除,数据策展/遗忘/剪枝是关键策略 — gkdziugaite · 2026-09-16