Eleanor Berger 公开 2026 年 9 月个人模型阵容与订阅选择
intellectronica · x · 2026-09-12
Eleanor Berger 在博客 The September 2026 Lineup 中分享了当前日常使用的模型与订阅组合:
- 方法论:每周都有新模型发布,她会密集试用大部分新模型,但只长期保留少数几个「吃透」的——公开 benchmark 不够,真实使用经验不可替代。
- 成本观:好模型价值大、愿意花钱,但同样在意性价比,持续寻找便宜的替代。
- 当前主力:OpenAI GPT-6 Astra(light/lowmedium effort),日常主力,浏览器与计算机任务自动化、即时思考表现出色;靠大预训练而非长推理链,速度快很多。单 token 价格是 5.6-Sol 的 2.5 倍,但低 effort 下实际成本与 Sol 中高 effort 相当且更快;medium effort 下达到「AGI 级」的智力与精致度。
- 另外点名了让她意外的两款发布:Meta Muse Spark 1.3(maximum effort)与 xAI 的 Grok(正文截断,细节未展开)。
「模型」频道最新
- DeepSeek V4.1 Flash 上线 Merge Gateway,登顶 Terminal-Bench 2.1 — shensi · 2026-09-12
- 2019 剪枝实验称可删 96% 权重,GPT-5 多数参数是空架子 — TinfoilTricorn · 2026-09-12
- DeepSeek V4-Pro-0813 与 GLM-5.3 上线 Nebius,主打编码与 Agent 工作流 — Arindam_1729 · 2026-09-12
- GPT-6 Astra 降智实锤:OpenAI 承认并部分修复,用户呼吁定期复测 — SteveEricJordan · 2026-09-12
- 用 Codex 高档模式订一周食材,耗掉月度额度 10% — iandanforth · 2026-09-12
- GLM 5.3 Flash 聊天体验拉胯,用户转投 Qwen 小模型 — HornyGooner4402 · 2026-09-12