Astra 发布十天:开发者实测称 CUA/视觉大进步,但无智能跃迁
tokenbender · x · 2026-09-13
开发者 tokenbender 在 Astra 发布十天后复盘:信息流上的评测大多停留在 "第一天印象",而模型真实水平只有在发布后用对抗性方式推到分布之外才能看清——他称之为格耳曼失忆效应在模型评测中的体现。
他的结论:Astra 在 CUA(计算机使用)与视觉能力上确实比前作强很多,但没有任何基础智能跃迁的迹象。想判断模型价值,只有把它拖到深处 "看它挣扎" 这一途。
「模型」频道最新
- 用户视角:模型频繁弃用正把人推向开源权重模型 — marlene_zw · 2026-09-13
- 西湖大学提出 Code World Model:用代码保世界规则,视频只管渲染 — jiqizhixin · 2026-09-13
- Abacus AI 发布 Smaug Mini 27B 开放权重,Flash 定价低至 $0.1/M — bindureddy · 2026-09-13
- 独立项目 AkbasCore 2.0:阻尼多轴激活转向内核在 Qwen2.5-7B 上验证 — Nearby_Indication474 · 2026-09-13
- 幽默或是 LLM 最后短板,开发者问谁来建幽默基准 — abhishekcode42 · 2026-09-13
- Astra 高推理档 ARC-AGI-3 更强,成本反而省 46% — daniel_mac8 · 2026-09-13