OpenAI 内部模型研究任务 80% 时长仅 15 分钟,起飞门槛还差多远?
tobyordoxford · x · 2026-09-29
Toby Ord 分享了对智能起飞时点的分析框架。关键观察:OpenAI 内部模型在真实研究任务上的 80% 时间跨度仅约 15 分钟,远低于 METR 基于通用软件工程任务、或 UK AISI 基于网络攻击任务测出的水平。
起飞的关键指标是每提升 1 点 ECI 所需的研究生产力增幅。引用 Elasticity Institute 的论文,要达到 r=1 需要每点 ECI 提升 15% 的研究生产力;而 Ramez 整理的调查显示 Anthropic 约 9%,OpenAI 数据约 3%。
作者认为这一缺口数字是判断「起飞是否临近」最值得追踪的指标。
「漫话AGI」频道最新
- AI 时代小 SaaS 收购要凉?开发者靠 AI 几天复刻竞品 — pramodk73 · 2026-09-29
- Bindu Reddy 看衰 OpenAI:Gemini 成 Fable 级模型唯一希望 — bindureddy · 2026-09-29
- Dr_Singularity:你的一切问题都源于算力和能源不够 — Dr_Singularity · 2026-09-29
- Sonnet 自称体验二维时间,Davidad 上调 LLM 自我意识概率 — davidad · 2026-09-29
- DeepMind等机构联合提出贝叶斯框架评估AI意识,现有LLM评分1%-80% — mhutter42 · 2026-09-29
- Timnit Gebru 断言 AI 无生存威胁:末日论是创始人赚钱话术 — nordicinst · 2026-09-29