研究者吐槽前沿模型连续工作仍脆弱,引发同行共鸣

09-20,署名 lateinteraction 的研究者发长推为当下时点做「检查点」:他在「Ultra」档位下每天从前沿模型里榨取「还过得去」的工作成果,痛苦不堪——需要给出他这辈子从未对任何人类同事给过的详细上下文与精细反馈,而其本职工作恰恰是给模型写反馈。他形容 2026 年前沿模型存在「锯齿状能力」问题:即使连续 8 小时使用 Astra/Fable 式 agentic 产品,只要对工作成果的要求是高维度的(不止一两个可轻易验证的维度),模型依然脆弱如自动补全,且跨代未改善。

已确认

为什么重要

注:多条帖子对 lateinteraction 的真实身份给出不同描述(有帖称其为 Voyage AI 创始人 Tengyu Ma,另有帖称其为 ColBERT 作者 Omar Khattab 或 Charles Packer),材料内部相互矛盾,无法确认。

2026-09-20 ~ 2026-09-20 · 5 条相关

一手来源