泼冷水:Astra 展示力强但离多步研究级思考仍差得远
xiaosun86 · x · 2026-09-07
开发者 xiaosun86 对大 V 们对 Astra 的集体吹捧表达反感,认为「平台上全是装腔作势的人」。他承认 Astra 确实更强、尤其在呈现效果上,但附上自己的 ChatGPT 对话测试(Visualize Trap Effects)指出:它仍达不到单步研究级思考的水平——而真正有意义的工作需要多步全部正确。「还有很长的路要走。」
所属事件:实测质疑 Astra 热潮:演示惊艳但多步推理仍差一步(4 条相关)→
「模型」频道最新
- 合成数据已成训练主流:小模型训练本质是蒸馏 — RexDouglass · 2026-09-07
- Sol High 用量实测:复杂写作项目一次吃掉 5 小时限额的 5% — remixedmoon5 · 2026-09-07
- 印度非营利组织 Bodhan AI 开源全套印度语言语音视觉翻译模型 — selfawareatom · 2026-09-07
- Claude Max 用户称用量限制连续一周出现乱跳 bug — tonimedic · 2026-09-07
- 开发者提醒:Astra 擅长可展示的领域,但 AGI 关键在系统级理解 — Scobleizer · 2026-09-07
- 腾讯开源 EVIE 视觉文档检索模型,ViDoRe V3 达 66.75 — jacek2023 · 2026-09-07