研究者的抱怨:拿万亿参数 LLM 当基线并不公平
mariotelfig · x · 2026-09-11
Mario Teguh Sihalath 指出,如今在论文里与强 LLM 基线对比,就像 510 年前与人类对比一样不公平:顶级 LLM 有上万亿参数、训练成本数百万美元且通用。很多时候你要找的是解决特定问题的聪明、高效方案,即使它跑不过 LLM。这触及了学术评测中「小方法 vs 通用大模型」的基线之争。
「研究」频道最新
- KL 散度新视角统一 Shampoo 与 SOAP,提出免 Adam 的 KL-Shampoo — _arohan_ · 2026-09-11
- Dankrad:P=NP 若被证明,对密码学大概率毫无影响 — soumitrashukla9 · 2026-09-11
- NVIDIA BioNeMo 推理运行时公测,SandboxAQ 联手做可溯源药物发现 — AllThingsApx · 2026-09-11
- P=NP 恰好是 AI 最擅长证明的:派海量 Agent 搜多项式解 — soumitrashukla9 · 2026-09-11
- NASA 发布基于 17 年月球的「月球 AI 模型」,加速陨石坑与冰层探测 — Polymarket · 2026-09-11
- ICLR 向投稿者开放 Google Paper Assistant,SAI 也提供免费预审 — ChenhaoTan · 2026-09-11