知名AI研究者:模型连续工作8小时仍脆如自动补全,跨代未改善
lateinteraction · x · 2026-09-20
知名 AI 研究者 lateinteraction 发长推给当下时点做"检查点":模型在真实工作里仍然不够好——如果你对工作成果的要求是高维度的(不止一两个可轻易验证的维度),很快就会对哪怕 8 小时连续的 Astra/Fable 式 agent 工作有多脆弱、多像"自动补全"感到崩溃。
- 他承认那些稀疏的、可验证的成功案例会越来越多,但这些孤例本身并不能说明什么。
- 关键判断:从模型一代到下一代、能力水平提升 10,000 倍,似乎有某种根本性的东西始终没有松动。
- 他强调自己没有替代方案可推销,也不否认已有进展和创造的巨大价值,只是记录当下:如果明天就改变,他会是最开心的人。
所属事件:研究者吐槽前沿模型连续工作仍脆弱,引发同行共鸣(5 条相关)→
「漫话AGI」频道最新
- ML 元老 Burkov 炮轰辞职的 AI 科学家:入职时到底想不想造真 AI? — burkov · 2026-09-20
- Domingos:AI 让「知道做什么」更值钱,「知道怎么做」更不值钱 — pmddomingos · 2026-09-20
- SF 观察:AI 安全圈的「高人一等」语气正在引发公众反感 — signulll · 2026-09-20
- Vitalik 公开表态:坦承 EA 是核心信念,并自辩脱离长期主义 — inductionheads · 2026-09-20
- Noam Brown 称气隙隔不断 AI,Cantrill 斥「恐惧传染」 — brianmichel · 2026-09-20
- Grady Booch 转评:5000 亿美元 AI 基建大单实为意向书式公关 — Grady_Booch · 2026-09-20