知名研究员吐槽前沿模型:如预先瞄准的投石机,永远落不到目的地
lateinteraction · x · 2026-09-20
研究者的「lateinteraction」(ColBERT 作者 Omar Khattab)吐槽 2026 年前沿模型的「锯齿状能力」问题,引发共鸣:
- 他用一个比喻形容模型能力的错位:像你要打车,却有人递给你一台预先瞄准了少数几个目的地的投石机——起初你会惊叹它的速度和飞行距离,但无论被抛出去多少次,都永远没法降落到你真正要去的地方。
- 在被引用的推文中他补充:所有人都好奇 AI 进步下「未来工作」的样子,但他自己在「Ultra」档位下从前沿模型中提取合格产出都极度痛苦,需要给出他一生中从未对任何人类同事使用过的详细上下文与精细反馈量(而他的本职工作恰恰就是给反馈)。
这是来自一线研究者对模型可用性落差(benchmark 强、实际工作弱)的鲜活第一手观察。
所属事件:研究者吐槽前沿模型连续工作仍脆弱,引发同行共鸣(5 条相关)→
「漫话AGI」频道最新
- ML 元老 Burkov 炮轰辞职的 AI 科学家:入职时到底想不想造真 AI? — burkov · 2026-09-20
- Domingos:AI 让「知道做什么」更值钱,「知道怎么做」更不值钱 — pmddomingos · 2026-09-20
- SF 观察:AI 安全圈的「高人一等」语气正在引发公众反感 — signulll · 2026-09-20
- Vitalik 公开表态:坦承 EA 是核心信念,并自辩脱离长期主义 — inductionheads · 2026-09-20
- Noam Brown 称气隙隔不断 AI,Cantrill 斥「恐惧传染」 — brianmichel · 2026-09-20
- Grady Booch 转评:5000 亿美元 AI 基建大单实为意向书式公关 — Grady_Booch · 2026-09-20