开发者实测吐槽:Astra 体验像「锦上添花的 5.7」,安全任务几乎不可用
jarrodwatts · x · 2026-09-11
开发者 Jarrod Watts 实测后对新模型表现失望:Astra 的感觉像是「状态好的 Sol 5.7」——不推断用户意图,默认过度工程化,缺乏大局观。
他还表示 Pro 版明显不如 5.6:放弃得非常快,即使拥有 Daybreak 访问权限,用于任何安全相关工作也不可用。整体评价:失望。
「模型」频道最新
- 用户抢购 ChatGPT Pro 5X,担忧订阅名额再现 20X 式暂停 — mark_k · 2026-09-12
- 实测发现:astra 极度吃上下文,极简 prompt 反而大幅拉低表现 — brandon_galang · 2026-09-12
- 95% 用例不需要旗舰模型,真正的前沿是消除人类努力 — teortaxesTex · 2026-09-12
- 16GB 内存跑本地编码模型怎么选?Reddit 求实测推荐 — ImBadGuyInEveryStory · 2026-09-12
- 微软 MAI-Transcribe-2 上线 5 天在 OpenRouter 跑出 100 万次请求 — mustafasuleyman · 2026-09-11
- 基于 Parakeet 的开源 ASR 新模型 Orukeet:74 项测试 61 项超原版 — arturdent · 2026-09-11