实测者泼冷水:Astra 展示强但单步推理仍够不到研究级

xiaosun86 · x · 2026-09-07

作者对大账号们对 Astra 的集体 hype 表示反感,称平台上满是 posers。他认为 Astra 确实更好、尤其是呈现效果,但距离研究级思考还差一步:他分享了一个 ChatGPT 对话(Visualize Trap Effects)作为例证,并指出有意义的工作需要多步全部正确,单步正确率不足会迅速累积成失败。

所属事件:实测质疑 Astra 热潮:演示惊艳但多步推理仍差一步(4 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →