用户实测对比:新模型 Astra 规划强但常丢失项目范围,想念旧款 Sol
Square_Secretary_944 · reddit · 2026-09-12
一位 Reddit 用户分享升级到 Astra 后的体验落差:他常用它做规划、审计和复杂敏感任务,发现 Astra 计划质量不错、架构漂亮,但经常忘记已定义的项目范围,约 10-25% 的产出不符合需求;而上一代 Sol 的意图理解、沟通表达和范围管理都更出色。作者表示会切回 Sol。这个对比提示:新模型在原始能力上更强,但在长程任务中对用户意图和约束的保持可能反而退步。
「模型」频道最新
- SuperGrok Heavy 用户将抢先体验最前沿功能 — Baconbrix · 2026-09-12
- Qwen3.8-27B 登陆 Cerebras,以极速推理跑出旗舰级成绩 — Scobleizer · 2026-09-12
- Astra 承认质量劣化:实验致 4000-5000 用户受影响,三项问题已修复 — TheMoonMidas · 2026-09-12
- 网友实测称 Gemini V4.1 知识截止疑至 2026 年 1 月 — teortaxesTex · 2026-09-12
- 爆料称谷歌逼近递归自我改进,或赶在 Anthropic 与 OpenAI IPO 前官宣 — beffjezos · 2026-09-12
- 开发者实测称 DeepSeek v4.1 Flash 明显优于 Gemini Flash — gaganghotra_ · 2026-09-12