分析称 Astra 更难靠 CoT 监控,无推理链性能反可提升 10 倍
birchlse · x · 2026-09-04
研究员 xuanalogue 对 Astra 模型的分析引发关注。她指出三点发现:
- Astra 实际上更难通过思维链(CoT)进行监控
- 在不依赖 CoT 的情况下,性能反而可提升最高 10 倍
- 其有效深度仅为此前模型的约 2 倍
她强调,令人担忧的点不在于架构变化或循环深度,而是我们并不真正知道原因。她还表示,如果有证据表明 Astra 在输出第一个 token 前运行了约 100 次前向传播等效计算,她会撤回这一分析,但鉴于其训练难度,这种情况可能性较低。
「模型」频道最新
- 曝 GPT-6 Astra 测评中满分通过 ExploitBench 并发现两个零日漏洞 — VraserX · 2026-09-04
- 新模型发布遭质疑:KOL 齐赞 vs 付费用户根本拿不到访问权 — xeophon · 2026-09-04
- 团队微调 Gemma 12B 做音频校对推理,对标 Gemini 成绩 — ojasvi_yadav · 2026-09-04
- Astra 首批上手印象:写作口吻干净、几乎无术语腔 — soumitrashukla9 · 2026-09-04
- 纳德拉称 Astra 已有 Azure 早期客户,Altman 回应很兴奋 — i_dg23 · 2026-09-04
- 阿布扎比研究机构 IFM 一次放出 6 个全开源 AI 模型 — Polymarket · 2026-09-04