开发者实测 Astra:用量消耗与 Sol 相当,系统设计仍需大量人工引导
zeeg · x · 2026-09-11
开发者 zeeg 分享对 Astra 模型的初步实测:与 Sol 相比,Astra 的用量消耗速度没有明显更快,但在他交给它的大部分任务上也没有感知到实质性差距;在好的系统设计方面,两者仍都需要相当多的人工引导(steering)。他在后续回复中补充,Astra 的回复确实比 Sol「没那么烦人」。
这是一条一线使用观察:核心结论是新一代模型的用量成本相近,但自主完成系统级设计的能力尚未明显突破,人的引导仍是关键。
所属事件:开发者实测 GPT-6 Astra:速度超预期、定价与 Sonnet 持平(6 条相关)→
「模型」频道最新
- 用户吐槽 Astra 额度比 Fable 更坑:一天烧光一周配额 — cocktailpeanut · 2026-09-11
- DeepSeek V4.1 Flash 架构解析:552B MoE 读写算力不对称省上下文成本 — demian_ai · 2026-09-11
- 知情人:Codex 选择性加入数据进训练的可能性为零 — soumitrashukla9 · 2026-09-11
- Epoch AI 数学基准 14 个月从 5% 飙至 98%,宣布饱和 — Jsevillamol · 2026-09-11
- FrontierMath Tier 4 全军覆没:GPT-6 Astra 解出最后一题 — Jsevillamol · 2026-09-11
- Anthropic 披露:阿里 1.51 亿次调用蒸馏 Claude,Kimi、DeepSeek 也涉其中 — likeastar20 · 2026-09-11