开发者实测:Astra 自信满满却全错,改动致性能回归
cnakazawa · x · 2026-09-05
开发者 cnakazawa 分享对新模型 Astra 的一次实测结果:模型对自己的判断表现得很自信,但结论完全错误——它提议的改动不仅没有带来有意义的性能提升,反而造成了性能回退。作者以「Phew(还好)」的口吻收尾,暗示幸好只是虚惊,但也暴露了新模型在工程场景中「自信但不可靠」的问题。
「Fun」频道最新
- 海报被围攻快撑不住时,导师出现了:学术圈名场面 — docmilanfar · 2026-09-05
- 圈内热转:财富自由后靠 10% 努力维持影响力是种病 — vaibhavbetter · 2026-09-05
- GPT-6 Astra 11 分钟造出可弹奏虚拟钢琴,内置巴赫六首勃兰登堡协奏曲 — DeryaTR_ · 2026-09-05
- GPT-6 被吹 AGI,却画不出一条头身相连的贪吃蛇 — SnooCheesecakes1893 · 2026-09-05
- 传 GPT-6 Astra 解决 Hadwiger–Nelson 问题?结论连专家都不敢信 — MikePFrank · 2026-09-05
- Qwen3.8-27B 玩维基百科游戏,10 次点击内 6 步通关 — swagonflyyyy · 2026-09-05