开发者实测:Astra 擅长自主目标推进,指令遵循却不及 Sol
MinqiJiang · x · 2026-09-07
开发者 Minqi Jiang 分享对比观察:Astra 在有明确验证器的目标追求上表现出色,但在指令遵循上不如 Sol,常出现范围蔓延或偏离原意。他据此提出一个值得警惕的猜想:新模型可能过度优化了 RSI/自主能力,而牺牲了人机协作的服从性。
「漫话AGI」频道最新
- KOL 实测 Astra:称其缺主见仍只是码猴,预测 GPT-6 并非 10T 参数 — scaling01 · 2026-09-07
- 经济学人:AI 创造超百万新岗位,美国就业末日被推迟 — soumitrashukla9 · 2026-09-07
- 用AI算账:12人团队每月8400美元办公室租金去留决策 — Div_pradeep · 2026-09-07
- Replit CEO:未到 AGI 但功能上已无法区分,能写成代码的问题近乎解决 — amasad · 2026-09-07
- 「我又一次低估了语言的力量,又一次被 Bitter Lesson 教训」 — k7agar · 2026-09-07
- 博主倡导「计算新闻学」:用可交互模拟替代口水战 — anselm · 2026-09-07