泼冷水:Astra 展示力强但离多步研究级思考仍差得远

xiaosun86 · x · 2026-09-07

开发者 xiaosun86 对大 V 们对 Astra 的集体吹捧表达反感,认为「平台上全是装腔作势的人」。他承认 Astra 确实更强、尤其在呈现效果上,但附上自己的 ChatGPT 对话测试(Visualize Trap Effects)指出:它仍达不到单步研究级思考的水平——而真正有意义的工作需要多步全部正确。「还有很长的路要走。」

所属事件:实测质疑 Astra 热潮:演示惊艳但多步推理仍差一步(4 条相关)→

原文链接 →

「模型」频道最新

更多「模型」频道 AI 资讯 →