长文探讨:前沿模型进步太快,AI 基准测试已跟不上节奏
knowerofmarkets · x · 2026-09-24
作者在长文中表示,近几个月前沿模型的更新速度令人应接不暇,几乎每隔几小时就有新进展,导致其撰写的 AI 基准测试文章迟迟找不到稳定的叙事框架。文章指出,判断模型变强的证据已从个人体验(一个过去要干一整天的工作任务,现在模型可直接完成)延伸到每周更新的模型发布博客与基准对比,业界对「超级智能是否临近」的讨论正因这种进展节奏而不断升温。
「漫话AGI」频道最新
- 开发者疑惑:为何这么多 VC 反对 AI 安全 — jungofthewon · 2026-09-25
- 摩根士丹利 Adam Jonas:AI 加机器人或使全球 GDP 增长 8-10 倍 — Rewkang · 2026-09-25
- 研究员困惑:为什么这么多风投反 AI 安全? — jungofthewon · 2026-09-25
- CNN 质疑「AI 将杀死人类」论:技术上如何发生? — mmitchell_ai · 2026-09-25
- Benjamin Bratton:奇点叙事错了,智能爆炸将像演化一样是社交性的 — bratton · 2026-09-24
- AI 致行政诉讼激增,有人提议用预测市场定价纠纷以促和解 — devanshmehta · 2026-09-24