GPT-6 数学最强却受困小上下文,长任务仍靠 Fable 5.1
MParakhin · x · 2026-09-06
前微软 Bing 工程副总裁 Mikhail Parakhin 分享对 GPT-6 与 Fable 5.1 的重度使用体验:
- GPT-6 Max 是他见过数学/ML 领域最强的模型,超过 5.2 Pro;今早 Web 端已出现 6 Pro,他准备测试
- 但 GPT-6 上下文空间极小,严重拖累实用性,他形容像「和超聪明的多莉鱼(Dory)对话」——记住的东西转瞬即忘
- Fable 5.1 在长程 agent 任务上仍是最佳,指令遵循更好、代码方案更优雅
他的实际工作流已经「角色互换」:先用 GPT-6 设计开发方案,再用 Fable 5.1 打磨代码并跑实验。
「模型」频道最新
- Astra 发布引 AI-CAD 爆发周末:从旧金山宫殿重建到多软件 3D 建模井喷 — burhop · 2026-09-06
- Dan Jeffries:模型嵌入推理后,CoT 蒸馏指控将不攻自破 — Dan_Jeffries1 · 2026-09-06
- Alexandr Wang 让大家去试试 Muse Spark 1.3 max,被称 Opus 级 — alexandr_wang · 2026-09-06
- 模型不爱用编辑工具,宁愿直接用 Python 改文件 — xeophon · 2026-09-06
- ChatGPT 代理可绕过 Cloudflare 人机验证,研究者忧 AI 行业「破门文化」 — GaelVaroquaux · 2026-09-06
- 用户对比:Astra 的语言表达明显优于 Sol,告别 QA 腔文档 — raskingballs · 2026-09-06