烧掉 3000 亿 token 毫无突破,内部模型 3 小时破局
burny_tech · x · 2026-10-08
Moonshot AI 产品负责人 Peter Gostiev 回应关于「OpenAI 内部模型 vs Astra 数学能力差距」的争论,给出自己的对比案例:他在 Hadwiger–Nelson 问题上耗费了约 3000 亿 token(GPT-5.6 与 Astra)毫无进展;而据称 Bell 用 Pro 内部模型仅 3 小时就取得突破(证明五色不行、下界推进到 6 或 7 色,尚未完全解决)。他请 Astra 分析自己已有工作与论文的差距,得到的结论是「还差两个数学突破」。他认为两者的能力差距大得「不可思议」,并强调这只是单一案例。此讨论与 ConstantinKogl 的观点形成对照——后者认为内部模型「更好但没有好得离谱」,148 号论文的结果他自己用 Astra 也复现过。
所属事件:OpenAI 内部模型解数学难题 3000 亿 token 无果后 3 小时突破(2 条相关)→
「模型」频道最新
- 开发者热议:ColBERT 式 late interaction 还算不算 cross-encoder 重排器 — CShorten30 · 2026-10-08
- Claude Projects 支持定时任务,可自动周期执行项目工作 — ColleenMBrady · 2026-10-08
- 曝 X 准备全合一订阅:X、Grok、Cursor 共享一个用量池 — nima_owji · 2026-10-08
- 4 模型跨文件修 bug 实测:3/4 通过,成本相差 10 倍,最便宜的反倒最慢翻车 — lulzxdxdxd · 2026-10-08
- Google 调整 Gemini 免费策略:Flash 与 Pro 即将转入付费计划 — Robert__Sinclair · 2026-10-08
- Apollo Research:最终检查点测试抓不住早期失调风险 — dl_weekly · 2026-10-08