luislamb 重申:把 benchmark 当真实进展是 AI 行业的连锁误判
luislamb · x · 2026-09-22
研究者 luislamb 在 2026 年 9 月重申其观点:AI 行业许多人(包括研究者)把基准测试成绩误认为真实进展。他强调 benchmark 分数并不必然对应真实世界用例,这种逻辑缺陷只是行业一系列连锁错误之一。
「漫话AGI」频道最新
- 对齐像养孩子:自动化前辈称 AI 安全须靠持续监督 — apsarathchandar · 2026-09-22
- Richard Socher:写代码本身就是符号推理,LLM 边界正模糊 — RichardSocher · 2026-09-22
- Richard Socher:AI 硬起飞论低估了物理世界的推进速度 — RichardSocher · 2026-09-22
- 谷歌与 DeepMind 组建「AI × 经济」团队,专攻 AGI 经济学研究 — soumitrashukla9 · 2026-09-22
- Hugging Face CEO:90% 的真实场景里,LLM API 并非最佳方案 — multiply_matrix · 2026-09-22
- 剑桥学者 Krueger:别听 AI CEO 的,他们不是最懂 AI 的人 — DavidSKrueger · 2026-09-22